全网信息技术服务商

电脑端+手机端+微信端+APP端(安卓+IOS),全网覆盖

0532-89269576

Hermes Agent v0.20与Qwen3.8的同一天:AI Agent的两种进化路径

发布时间:2026-08-08 编辑:智序网络 浏览:124 次

8月3日,AI Agent圈同时发生了两件事。

Nous Research 发布了 Hermes Agent v0.20.0,代号"The Herald Release"(传令神版),单版本合并约1400个PR、3650次提交、650+贡献者参与。同一天,阿里巴巴正式发布 Qwen3.8,总参数量2.4万亿,编程能力全球第四。更引人注目的是,Qwen3.8在独立编程16天后,自己"搓"出了一个 Hermes Agent 级别的自进化智能体框架"oh-my-cli"。

两个项目,同一个方向:AI Agent 正在从工具变成基础设施。

语音从"留言机"到"打电话"

Hermes Agent v0.20 最直观的变化是语音交互。

以前的模式被官方称为"语音留言互发"——你说完,等它生成完一整段回复,再听一个音频文件。想打断?没门。

v0.20 改成流式输出:AI 边生成边逐句朗读,你随时开口打断,它立刻停,切换到倾听状态。还支持本地唤醒词,比如"hey Hermes",检测完全在本地完成,音频不外传。

这个变化看起来不大,但意义很关键。AI Agent 的交互方式从"提交任务-等待结果"变成了"对话式协作",用户可以在执行过程中实时纠正方向,而不必等任务跑完再重来。

同时,WhatsApp、LINE、QQ、飞书等平台都支持了语音消息转录与回复。Hermes 在这些渠道上不再是纯文字 bot,而是可以接收和发送语音的 AI Agent。

多智能体开始说话

另一个核心升级是 A2A v1.0 协议(Agent-to-Agent)。

Google 在 2024 年底推出了 A2A 协议,2025 年 12 月华为在 HarmonyOS 6 上实现了商用落地,今年 7 月已经有超过 150 家组织支持该协议。A2A 的本质是让不同 AI Agent 之间能互相发现、协商任务、交换结果,而不需要人类居中协调。

Hermes Agent v0.20 的 A2A 实现,意味着你可以启动多个 Hermes 实例,一个负责搜索、一个负责代码执行、一个负责用户界面,主 Agent 负责调度和汇总。

当然,A2A v1.0 还处在早期阶段。要真正发挥多智能体协同的效果,各个节点的工具调用能力和上下文共享机制需要额外的工程设计。这不是开箱即用的"几个 Agent 自动协作",而是提供了一套协议和 SDK,开发者来决定怎么组网。

Qwen3.8 的16天自主编程

同一天发布的 Qwen3.8,展示了另一种进化路径。

总参数量 2.4 万亿,激活 95B,支持 1M Tokens 长上下文。在 CodeArena 编程榜单中位居全球第四。

最让人意外的不是参数规模,而是一个实验:给 Qwen3.8 一句指令"创建一个自进化的智能体 Harness",让它从零开始自主编程。

16 天后,Qwen3.8 交付了一个 Hermes Agent 级别的自进化智能体框架"oh-my-cli",完整过程公开保存在 GitHub 上。

这不是简单的代码生成。Qwen3.8 在16天里自主完成了需求分析、架构设计、编码实现、测试调试、迭代优化的完整软件开发流程。过程中,它还通过钉钉接收了人类工程师的新需求,并据此调整了输出。

这意味着什么?

AI 大模型正在从"写代码的工具"变成"写 AI 的工具"。

阿里官方称这种能力为"循环工程"(Loop Engineering)——模型自己编排任务、领取执行、反馈迭代,人类工程师只需要提出初始需求和验收标准。

两种路径,同一个终点

Hermes Agent 和 Qwen3.8 代表了 AI Agent 发展的两条路径。

Hermes 是从 Agent 框架出发,逐步增强语音、多智能体、工具调用等能力,目标是让 Agent 更像一个持续在线的"数字同事"。它的优势是开源、可本地部署、支持 200+ 模型,社区活跃,版本迭代节奏稳定(约两周一个命名版本)。

Qwen3.8 是从大模型出发,通过提升模型的自主编程和长周期任务执行能力,让模型本身就能"长出" Agent 框架。它的优势是单模型能力极强,2.4 万亿参数、1M 上下文、全球第四的编程能力,且价格远低于竞品(输入价格仅为 Opus 5 的 40%)。

两条路径的共同结论是:AI Agent 正在从"帮人类干活的工具"变成"能自己定义和执行任务的基础设施"。

从 Hermes Agent 的语音打断、A2A 多智能体协作,到 Qwen3.8 的16天自主编程,都在指向同一个方向:未来的 AI Agent 不再只是等待指令的执行者,而是能够理解目标、拆解任务、协调资源、交付结果的自主系统。

对于开发者来说,这意味着工作方式的根本转变。

你不需要学习一套新的 Agent 框架来干活,你需要学会的是:如何提出清晰的目标,如何验收成果,如何在 Agent 执行过程中进行关键节点的纠偏。

AI Agent 的竞争,已经从"谁的模型更聪明"转向"谁能更稳定地把任务做完"。

升级还是观望?

Hermes Agent v0.20 对现有用户是个重大升级,但有几个实际考量:

工具调用上限从 90 提升到 500,意味着复杂任务不再被硬截断,但实际消耗取决于任务复杂度,建议配合 Token 预算管理使用。

语音功能默认不开启,需要手动配置 STT 端点。

A2A 协议层已就位,但需要对端也实现 A2A 兼容才能使用,目前最适合的验证方式是启动两个 Hermes 实例进行本地测试。

Qwen3.8 的 API 已经上线,价格极具竞争力,但 Max 版本预计下周才开源,短期适合 API 调用,长期开源后本地部署成本会进一步降低。

无论选择哪条路径,AI Agent 正在快速脱离"尝鲜工具"的阶段,进入"生产级基础设施"的门槛。 对于已经在用 OpenClaw、Hermes 或 Claude Code 的团队来说,这次更新值得认真评估。

---

本文综合了博客园 vibecodinghuanzhe 的 Hermes Agent v0.20.0 全解、搜狐/钱江晚报的 Qwen3.8 发布报道、腾讯云的 Hermes Agent 介绍,以及百度百科关于 A2A 协议的解析。

您的项目需求

*请认真填写需求信息,我们会在24小时内与您取得联系。