AI风向

Hermes Agent v0.19.0 全面解析:80%速度提升、智能审批、子Agent实时监控,450人贡献的「水银」级更新

冷启动从4.3秒降到0.9秒,桌面端Markdown渲染快14倍,GPT-5.6全线支持,这个7月20日发布的版本可能是2026年最重要的AI Agent工具更新。

前言

如果你在用AI Agent做自动化,大概率逃不过三个工具:Claude Code、OpenAI Codex和Hermes Agent。而7月20日,Nous Research发布了Hermes Agent v0.19.0(代号The Quicksilver Release)——这个版本从v0.18.0以来合并了2,245次提交、1,065个PR,关闭了3,300个Issue,450+社区贡献者参与,是迄今最大的单次版本更新。

这不是一个常规的"修bug加feature"版本。这是一次对"AI Agent用起来为什么这么慢"的系统性回答。

本文基于官方Release Notes深度分析,聚焦AI创业者最关心的:速度提升、安全审批、多Agent协作和变现相关功能。

一、速度革命:Hermes终于不"深吸一口气"了

冷启动快了80%

用过Hermes的人都熟悉那种等待感——发完第一条消息,它要"想"几秒钟才开始回复。这是因为冷启动时要做一堆初始化:Discord能力检测、Ollama探测、Agent初始化……

v0.19.0把这些全砍了:
- Discord能力检测改为24小时磁盘缓存+后台刷新
- 已知非Ollama provider跳过探测
- Agent初始化阻塞工作移除

结果:冷启动→首Token时间从 ~4.3秒 降到 ~0.9秒,砍掉了约80%。

桌面端:14倍Markdown渲染加速 + 虚拟化Diff

桌面App是这次优化的主战场。20+个针对性PR解决了几个核心瓶颈:

  1. Markdown流式渲染:长回复以前在流式输出时,Markdown分词器消耗的CPU是现在的14倍。新版本用增量块词法分析,流式渲染不再卡顿。

  2. Diff查看不再卡死:大Diff以前会让Review面板冻结,现在用虚拟化渲染,只渲染可见区域。

  3. 会话切换不再"抖一下":旧版切换会话时布局级联重建,新版彻底消除。

  4. 不再每个Token都重渲染侧边栏和工具行:之前流式输出时每个token都会触发侧边栏(会话列表)和每个工具行的重新渲染——这是大量CPU白白浪费的地方。

  5. 启动优化:悬停时预加载Profile后端和Gateway连接,启动时隐藏的面板延迟挂载。

💡 对创业者的意义:桌面端的流畅度直接影响你每天的使用体验。如果你用Hermes管理多个项目和Agent,这些优化意味着你不再需要"等它加载完再切换"。

TUI也快了

终端用户也有福利:TUI现在增量渲染流式Markdown,按块输出而非逐行。

二、智能审批:LLM帮你判断命令风险

这是对日常使用体验影响最大的功能。

以前:Hermes每执行一个"需要审批"的命令(比如写文件、执行shell),都得弹窗问你。一天用下来,点几十次"允许"是常态。

现在:

  1. 智能审批默认开启:一个独立的LLM Reviewer会在后台评估每个命令。如果命令看起来安全(比如写入已经存在的文件、执行常规操作),自动放行;如果可疑,才弹窗问你。

  2. 每个命令独立判断:不会因为"上次允许了写入"就全部放行——每个命令得到自己的评估。

  3. 拒绝规则:你可以设置全局拒绝规则(比如禁止rm -rf),即使在YOLO模式下也不放行。

  4. /deny <reason>:拒绝后告诉Agent为什么拒绝,它会根据你的理由调整后续操作。

💡 对创业者的意义:如果你用Hermes做自动化运营(比如自动发公众号、自动回复评论),智能审批能大幅降低"等审批→点允许"的摩擦,同时不失安全性。

三、子Agent实时监控 + 耐久交付

实时Transcript

delegate_task现在返回实时Transcript文件——子Agent启动后,你可以tail -f实时看它在干什么:每一次工具调用、每一个结果、每一段响应。

这意味着:
- 派一批Agent去干活,你可以实时观察任何一个
- 发现问题立刻干预
- 不用等结果回来才发现走偏了

耐久交付账本

这是一个很底层的但很关键的改进:如果Gateway在生成完回复后、发出去之前崩溃了——以前的回复就丢了(但你已经付了Token费)。

v0.19.0引入了耐久交付账本(delivery-obligation ledger),最终回复在发给平台前先写入state.db,如果发送失败,下次启动时自动重发。

💡 对创业者的意义:如果你用Hermes跑Cron任务(定时发布内容、监控热点),这个改进意味着你不会因为网络波动丢失已生成的内容。

四、密码管理器集成:告别明文.env

API Key不再需要放在纯文本的.env文件里了。

v0.19.0引入可插拔的SecretSource接口,支持:
- Bitwarden:从你的密码管理器拉取API Key
- 1Passwordop://引用):用1Password的Secret Reference

多个Vault可以同时启用,有明确的优先级、冲突告警和每个变量的来源追踪。

💡 对创业者的意义:如果你的AI Agent项目涉及多个API(微信、OpenAI、Cloudflare、Supabase……),管理几十个Key是安全噩梦。密码管理器集成让你可以在一个地方管理所有密钥,而且不是明文存储。

五、GPT-5.6 全线支持 + 推理力度调优

模型支持方面,v0.19.0新增:
- GPT-5.6(Sol/Terra/Luna + Pro变体),端到端支持
- Grok-4.5(GA)
- MoonshotAI/Kimi-K3
- Claude Fable 5 / Claude Sonnet 5
- Tencent/HY3(GA)
- Fireworks AIDeepInfra 成为一线Provider

推理力度(Reasoning Effort)新增maxultra级别,可以按模型分别配置。MoA(多Agent协作)模式中,可以给"顾问"Agent设高推理力度,给"综合"Agent设低推理力度。

六、订阅管理:终端直接操作

/subscription/topup让你不用离开终端就能管理Nous订阅:
- 查看当前计划和剩余额度
- 预览升级费用("支付$46.30立即升级")
- 降级时显示生效时间
- 桌面端有对应的Billing设置Tab

💡 对创业者的意义:用Hermes做商业项目的人,可以直接在工具里管理付费,不需要切换到网页。

七、其他重要更新速览

功能 说明
会话导出 支持Markdown/HTML/HuggingFace格式,可选Secret脱敏
Profile路由 一个Gateway Bot按频道/线程路由到不同Profile
MCP命名 mcp__server__tool新命名规范
安全加固 6个P1安全PR、Token脱敏、凭据隔离
Cron耐久 Cron任务执行审计日志、一次性任务竞态修复
Claude Code更新 Claude Opus 5默认模型、嵌套子Agent深度3

八、实战场景:一人公司如何用v0.19.0提效

场景1:自动化内容发布

假设你用Hermes跑定时任务——每天搜热点、写草稿、发公众号。

v0.19.0之前:你可能会遇到"Cron跑了但文章没发出去"的情况。回头查日志,发现是某次API调用超时导致Agent中断,已经生成的回复也丢了。

v0.19.0之后:耐久交付账本保证内容不丢。即使Gateway崩了,回复在下次启动时自动重发。配合智能审批(写文件、调API自动放行),整个流水线的可靠性大幅提升。

场景2:多项目并行开发

如果你同时在维护网站、写内容、调试支付系统——一个Profile对应一个项目。

v0.19.0的Profile路由让你可以用一个Gateway Bot同时管理多个项目:Discord里给不同频道分配不同Profile。工作频道的消息走"开发"Profile,内容频道的消息走"写作"Profile,互不干扰。

场景3:多Agent协作研究

派3个子Agent同时搜不同来源的热点新闻,实时看Transcript发现问题——不需要等10分钟后收结果才发现某个Agent跑偏了。

总结:这是Hermes从"能用"到"好用"的转折点

v0.19.0的核心主题是两个字:速度和可靠性

"慢了80%"的冷启动、"卡到怀疑人生"的长Diff渲染、"丢了就找不回来"的回复消失——这些都是日常使用中真正磨人的问题,而这个版本系统性地解决了它们。

对AI创业者来说,如果你已经在用Hermes做自动化,强烈建议升级——速度提升4倍、智能审批省下大量手动确认、耐久交付保证内容不丢。

如果你是观望者,v0.19.0让Hermes的成熟度上了一个台阶,值得认真评估。

下一步可以关注的
- 智能审批的自定义规则如何配置
- 子Agent实时监控在复杂工作流中的实战
- 密码管理器集成的最佳实践


AI创业 #HermesAgent #AIAgent #一人公司 #自动化工具 #开源