Hermes Agent 周报:v0.20.0 传令官落地——智能体开始互相说话了
8 月 3 日,两件事凑在了同一天。
Hermes 发了 v0.20.0,代号 The Herald Release——传令官。阿里把 Qwen3.8-Max 摆上台面,2.4 万亿参数,Max 级权重第一次宣布开源。
一个开源 agent 框架,一个国产旗舰模型,同一天发布,本身就有戏剧性。但这周真正让我想写下来的,是另一条线:智能体之间开始用同一种语言说话了。
Hermes 这周落地了 A2A v1.0——智能体对智能体协议。行业这边,8 月 6 日 OpenAI 牵头七家巨头发布 Agent Plugins 1.0.0,同一天智能体互联工作组公布 AIP 1.0 首批兼容实现。三个互操作标准,扎堆落在同一周。这不太像巧合。
先把 Hermes 这周的账报了
数据来自本地仓库 git 统计(8 月 3 日 ~ 8 月 9 日):
| 指标 | 数值 |
|---|---|
| 总提交 | 1,200 commits |
| 合并 PR | 23 个 |
| 贡献者 | 209 人 |
| 新功能 | 117 个 |
| Bug 修复 | 585 个 |
| 性能优化 | 64 个 |
| 版本 | v2026.8.3(v0.20.0) |
热门模块还是老面孔:desktop(167)、gateway(89)、agent(42)、cron(31)、tools(23)。desktop 又霸榜,不过这周的主角不在桌面端,在 v0.20.0 那套"传令官"叙事里。
v0.20.0:给智能体装嘴、装语言、装规矩
语音。 以前跟 agent 说话,是"说一句,等整段音频生成完,再听"——像留言信箱。v0.20.0 改成流式:回答边生成边说出来,说到一半你可以直接开口打断,它停下来听你说,模型也知道你插嘴了[1]。唤醒词在设备端本地跑,音频不出机器。飞书、钉钉、WhatsApp、QQ、Photon……所有能收音频的 gateway 平台都能发语音消息进去,转写、回答、再转成语音回给你[1]。
A2A v1.0。 一个打包进 Hermes 的插件实现了 Agent-to-Agent 协议,Hermes 能发现别的 A2A 兼容 agent、跟它对话、被它驱动。这个 issue(#514)是仓库里活得最久的 feature request 之一,终于关了[1]。
Outbound webhooks。 Hermes 开始主动往外推事件:会话活动、turn 完成、工具事件,带 HMAC 签名的 HTTP 请求,推到任何你注册的端点。做 CI、做告警、做仪表盘,不用再轮询[1]。
grounded-citations。 研究类输出每条论断都能溯源,引用会跟页面原文比对,不是模型凭记忆"引用";还有个事实核查模式,把任何文档扔进去,它告诉你哪些查证通过、哪些没有[1]。
这几件事凑一起,信息量挺大。voice 是给智能体装嘴,A2A 是给它装共同语言,webhook 是让它会"喊人",citations 是教它注明出处。翻译过来就是:agent 不再是孤零零的对话框,开始像个人一样,能说话、能对接、能汇报、能负责任。
顺手补上的几块拼图
CLI 来了一波 power 命令:!command 直接跑 shell 不消耗模型轮次;/init 扫项目生成 AGENTS.md;/diff、/context、/focus 各管一摊;hermes import-agent 一条命令把 Claude Code 或 Codex CLI 的配置迁过来[1]。
# 把 Claude Code 的配置搬进 Hermes
hermes import-agent
桌面端从聊天客户端变成了工作台。 artifacts 上线:生成物以带版本号的卡片渲染在右侧栏,沙箱化实时预览,HTML、小应用可以安全地边聊边跑;配套的插件 SDK 落地,看板(Kanban)是第一个官方插件;全局快捷键唤起 quick-entry 窗口,在任何地方把念头塞进任意会话;支持多窗口[1]。
压缩变得更"惜字"。 大窗口模型下工具结果会被主动裁剪,逐轮微压缩代替一次性大停顿,最近 N 条用户消息保证不丢——长会话不再动不动卡死或失忆[1]。智能审批也补了块拼图:hermes approvals suggest 会从你的审批历史里挖出可加白名单的候选,连续拒绝触发熔断,docker/podman 重定向命令新加了审批门[1]。
中途纠正(redirects)是我最想单独说的一项。以前 agent 走偏,只能打断重来,中间做对的活全废了。现在直接打字纠正,进行中的工作保留,它带着你的新指令改道——等于在对话里插了个"改道"手柄[1]。看着小,其实是使用体验的分水岭。
工具自愈(tools that fix themselves)属于"填坑型"改进。terminal 输出截断时完整内容溢写到文件;patch 检测到改动已应用就返回 no-op,不再让模型对着改好的代码怀疑人生;write_file 写完在磁盘上验证。默认工具迭代上限从 90 提到 500[1]。我的体感是,agent 卡住九成的情况不是模型笨,是工具失败后它拿不到足够上下文,只能瞎猜。让错误消息自己带恢复方案,比换更强的模型管用。
性能侧也有硬数字:hermes -w 冷启动从 ~14s 压到 ~1.8s,config 读取深拷贝去掉后 telemetry 闸门快了 54 倍,desktop 第二波 60fps 优化,空闲 CPU 接近零[1]。
视角拉远:这周行业在给智能体办"户口"
标准在扎堆。 8 月 6 日,OpenAI 牵头七家巨头发布 Agent Plugins 1.0.0,统一 agent 插件的打包和分发规范——Anthropic 没上桌[2]。同一天,智能体互联工作组公布 AIP 1.0 首批兼容实现,覆盖身份标识、能力声明、任务流转、行为追溯[2]。加上 Hermes 的 A2A v1.0,三个协议同一周落地。方向很一致:让不同家的 agent 能互相发现、互相调用。
开源模型继续卷。 Qwen3.8-Max:2.4 万亿总参、950 亿激活、100 万 token 上下文,OSWorld-Verified 86.1 分排第一,官方放了个"无人干预跑 16 天、留下 265 个 commit、127 个 PR"的自动编程测试,Max 权重明确下周上 HuggingFace 和 ModelScope[3]。DeepSeek V4-Flash 7 月 31 日公测,2840 亿总参、130 亿激活,九项基准全面超过自家 V4-Pro 预览版——小激活模型反超大模型,这个信号值得单独记一笔[3]。Mozilla 的报告说,开源和闭源的能力差距已经收敛到 3.3 个百分点,但真正把开源模型推进生产的团队只有 51%[8]。模型层已经不是瓶颈,卡点在工程。
钱在投票。 21 财经 8 月 5 日报道:八周之内,Qwen3.8-Max、Kimi K3、DeepSeek-V4-Flash、GLM-5.2、Seedance 2.5 五款国产模型接连亮相;OpenRouter 上美国企业调用中国模型的 token 占比,从 2025 年上半年的 4.5% 涨到 2026 年 2 月后的 30%+,峰值冲到 46%[4]。Coinbase 内部调研,91% 的工程师日常工作用不到 GPT、Claude 的极限性能[4]。Lindy 把业务 100% 从 Claude 迁到 DeepSeek-V4,推理成本降了约 90%[4]。摩根士丹利 8 月 4 日的报告专门拆了开放权重模型的账,按部署规模不同,自建回收期从 3 个月到 6 年不等[5]。
安全和监管在补课。 Black Hat 2026 上,Check Point 披露了 11 个 agent 框架漏洞,另一项研究说"人类审批"环节漏掉了约三分之一的威胁[6]。8 月 1 日,EU AI Act 正式进入执法阶段[7]。功能越强,越需要这些。
你看,这条线其实很连贯:模型层的能力天花板在被 K3、Qwen 们不断抬高,而 Hermes 这周干的事,是把智能体脚下那条坑坑洼洼的路修平,再发一张"身份证"。一个造车,一个修路,外加一个交管局,缺谁都跑不起来。
写在最后
回到开头那个巧合。8 月 3 日同一天,一个框架在教 agent 说话,一个模型把旗舰权重放开。两条线交汇,指向同一个方向:智能体要真正干活了,光有模型不够,得让它们能互相协作、能对接系统、能承担后果。
你上手 v0.20.0 的语音了吗?A2A、Agent Plugins、AIP 三个标准,你觉得哪个真能跑起来?评论区聊聊,我整理到下周的周报里。
来源索引
[1] Hermes Agent v0.20.0 Release Notes,github.com/NousResearch/hermes-agent/releases/tag/v2026.8.3
[2] xzhibot AI 前沿资讯:《Agent Plugins 1.0.0 发布》(2026-08-07)、《AIP 1.0 落地提速》(2026-08-06)
[3] AIHub:《Qwen3.8-Max 发布》(2026-08-03);澎湃新闻转引大模型之家:《DeepSeek V4-Flash 热力榜》(2026-07-31)
[4] 21 世纪经济报道:《中国大模型八周五连发,硅谷企业悄悄换底座》(2026-08-05)
[5] 摩根士丹利《开放权重模型与三种未来情景》,经财联社报道(2026-08-04)
[6] xzhibot AI 前沿资讯:《Black Hat 2026 Agent 安全风暴》(2026-08-08)
[7] xzhibot AI 前沿资讯:《EU AI Act 正式执法》(2026-08-06)
[8] Mozilla State of Open Source AI(与 SlashData 合作),2026-07
🛑 质检员合规自检表
| 数据项 | 来源 |
|---|---|
| 本周 1,200 commits / 23 PRs / 209 贡献者 / 版本 v2026.8.3 | hermes-weekly-digest.py 采集自 GitHub |
| v0.20.0 语音 / A2A v1.0 / webhook / citations / CLI / redirects / 性能数据 | Hermes Agent v0.20.0 Release Notes |
| Agent Plugins 1.0.0 / AIP 1.0 / Black Hat 11 漏洞 / EU AI Act 执法 | xzhibot AI 前沿资讯 |
| Qwen3.8-Max 参数与测试数据 / DeepSeek V4-Flash 基准 | AIHub、澎湃新闻转引大模型之家 |
| 美企调用占比 4.5%→30%+ / Coinbase 91% / Lindy 90% | 21 世纪经济报道 |
| 摩根士丹利回收期 3 个月-6 年 | 财联社 |
| Mozilla 3.3pp / 51% 落地率 | Mozilla State of Open Source AI |
更多推荐



所有评论(0)