logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Hermes Agent v0.19.0:4项升级:首Token快八成,子 Agent 看得见

最近我把 Hermes Agent 从 v0.18 升级到了 v0.19 Quicksilver,本以为又是一次平缓迭代,结果第一印象就被锤了——以前启动 Agent 等个好几秒才出现提示符,现在几乎是刚按下回车就出现欢迎消息。官方发布说明显示全平台冷启动首 Token 延迟从大约 4.3 秒降到了 0.9 秒,直接砍掉了 80%。这还只是其中一个变化。Quicksilver 版本累计合并了超过

文章图片
#开发语言#人工智能
AI Agent催生5个新岗位:数据与趋势

你有没有注意到最近 LinkedIn 上的一个奇怪现象:身边工程师刷到的猎头消息越来越少,AI Agent Engineer 这个职位却多了上千个?我查了一下数据,发现全美技术招聘总量比疫情前低了 34%,但 AI 相关的技术岗位暴增了 45%。这不是预测——是 Indeed Hiring Lab 和 LinkedIn 的实时数据。更关键的是,AI Agent Engineer 这个一年前几乎不存

文章图片
#人工智能#大数据
Anthropic用Claude处理95%查询的实战

我们团队最近在折腾内部数据查询自动化,结果发现,就算用上最新的大模型,面对真实的业务数据问题,回答准确率也惨不忍睹。他们做到了 95% 以上的内部查询准确率,而关键就在一套叫做“技能”的系统上。

文章图片
Claude Tag 解读,Agent 成为团队一员

Claude Tag 不是简单的功能迭代,而是重新定义了 AI 在协作中的位置。过去 Agent 是「你问它答」的孤立工具;现在它变成了 channel 里的常驻成员——拥有上下文的视角、可被团队 review 和反馈、且开销可管控。Anthropic 内部 65% 的生产代码由它生成不是神话,而是这种协作模式的自然产物。趁旧应用 8 月 3 日关停前,现在就迁移。先选一个活跃的 channel(

文章图片
#人工智能
Claude Code砍80%提示词:AI降本从拆Prompt债

真正的 AI 工程优化,不是一个 prompt 写得越来越厚,而是模型越来越强,我们写得越来越薄。Anthropic 的案例证明,砍掉 80% 的 prompt 不仅没有降智,反而提升了表现。这不是个例,而是一个可以复用到你自己的项目中的方法论。如果删掉这部分,模型还能不能完成 90% 的任务?如果答案是「能」,就删掉。记住:AI 降本的核心思路,不是换更便宜的模型,而是让现有模型用更少的 tok

文章图片
#人工智能
Datadog 用 Claude+Cursor 做测试驱动迁移:操作从45分钟缩至秒级的AI重构

Datadog 的 Stream Router 团队最近干了一件事:把一套跑在 FoundationDB 上的 KV 路由系统迁移到了 PostgreSQL。你可能觉得这没什么特别的。但他们用了一个你可能没试过的方法——。AI 不决定做什么、不决定怎么做,它只负责在测试已经定义好的轨道上执行。你可能也在想:「用 AI 做代码迁移?不就是给 prompt 让它写吗?Datadog 的经历告诉你:不是

文章图片
#人工智能#重构
K3 与 Kimi Code 实战:模型到终端 Agent

你可能注意到了,月之暗面近日发布了 Kimi K3——2.8T 参数的开源模型,也是第一个公开的 3T 级开源模型。但比参数数字更值得关注的,是同时上线的:一个能在你的终端里帮你读代码、修 bug、跑任务的 Agent 工具。模型竞赛是公司之间的事,但一个能直接塞进你工作流的终端 Agent,跟你关系很大。

文章图片
#人工智能
Codex 升级:GPT-5.6 指令+SDK 稳定版

两天前,OpenAI 同时做了两件事——给 Codex CLI 推送了一个小版本,顺手把标成了稳定版。你可能已经注意到了:GPT-5.6 发布后,各家 AI 编码工具都在跟进适配。Codex 这次 v0.144.6 的更新,看起来只是「刷新了内置模型指令」,但拆开看,信息量不小。

文章图片
#人工智能
Claude Code v2.1.218:自动不弹窗 Review后台跑

我昨天刚升完 v2.1.217,今天又弹出 v2.1.218。本来以为只是修 Bug 的补丁版,读完 changelog 发现这次藏着两个行为级的大变化。再加上 Review 变成后台子 Agent、MCP 调试终于可见——这次跟之前那些修修补补不是一个级别。

文章图片
#人工智能
开源新旗舰 GLM 实战:Claude Opus 真能被平替

我们一直关注开源模型能否追上闭源标杆。6月13日智谱发布了GLM-5.2,MoE架构744B参数(A40B激活)、1M上下文、MIT开源,直接对标Claude Opus 4.8。官方Terminal-Bench得分81.0 vs 85.0,差距4个百分点。但这4个百分点在真实工程场景里意味着什么?

文章图片
#语言模型
    共 34 条
  • 1
  • 2
  • 3
  • 4
  • 请选择