Hermes Agent v0.19.0 深度報導:性能革命與 MOA 功能成熟化
Hermes Agent 近期重大更新深度報導:性能革命與 MOA 功能成熟化
發佈日期:2026 年 7 月 21 日
作者:Manus AI
資料來源:Nous Research 官方 GitHub Release、官方文檔
摘要
Nous Research 在過去一週內推出了 Hermes Agent v0.19.0「Quicksilver 版本」,標誌著這個開源代理框架的一個重要里程碑。本次更新不僅帶來了性能的革命性提升——首 Token 時間下降 80%——更重要的是將 Mixture of Agents(MOA)功能從實驗特性升級為一級模型選擇,同時新增了企業級功能、密碼管理器集成、子代理實時監控等多項創新。本文將深入解析這些更新的技術細節、實際應用價值,以及對開源 AI 代理生態的影響。
第一部分:性能革命 — 首 Token 時間下降 80%
冷啟動時間的戲劇性改進
Hermes Agent v0.19.0 最引人矚目的改進是首 Token 時間(Time-to-First-Token,TTFT)的大幅下降。根據官方發佈說明 [1],冷啟動時的「Initializing agent…」階段從原來的約 4.3 秒降低至 0.9 秒,實現了 80% 的性能提升。這個改進不僅適用於命令行界面(CLI),還涵蓋了網關、終端用戶界面(TUI)、桌面應用和定時任務(cron)等所有平台。
“Cold-start ‘Initializing agent…’ used to eat ~4.3 seconds before your first turn even reached the model; it’s now ~0.9s, an ~80% cut that applies to the CLI, gateway, TUI, desktop, and cron alike.” [1]
這個改進的實際意義在於,用戶不再需要等待長時間的初始化過程。在實時應用、聊天機器人、API 服務等對延遲敏感的場景中,3.4 秒的時間節省可以顯著改善用戶體驗。
推理模型的實時流式輸出
除了冷啟動時間的改進,v0.19.0 還改進了用戶在等待期間看到的內容。推理模型(reasoning models)現在默認實時流式輸出其思考過程,而不是像之前那樣讓用戶盯著一個旋轉的加載指示器等待 30 秒。同時,回應框現在按 Token 繪製而非按行繪製,進一步提升了實時反饋的流暢性 [1]。
這一改進對於使用高級推理模型(如 GPT-5.6、Claude Opus)的用戶尤為重要,因為這些模型的推理過程本身就需要較長的時間,實時流式輸出讓用戶能夠看到模型的思考進展,而不是被迫等待。
桌面應用的 20+ 性能優化
Hermes 的桌面應用在本次更新中獲得了 20 多個針對性的性能優化 PR。其中最顯著的改進包括 [1]:
- Markdown 分割器性能提升 14 倍:長回應不再會因為 Markdown 處理而導致 CPU 使用率飆升
- 虛擬化 diffs:大型 diffs 曾經會凍結評審面板,現在已解決
- 會話切換流暢性:切換會話不再導致佈局抖動
- 流式渲染優化:流式不再重新渲染側邊欄和每個工具行
- 配置文件預熱:配置文件後端在懸停意圖時預熱
- 延遲挂載:啟動時隱藏的面板現在在空閒時挂載,而不是在冷啟動關鍵路徑上
這些優化的累積效果是,桌面應用在高負載下(即使有大型轉錄和繁忙的代理)感起來像一個原生應用。
第二部分:MOA 功能成熟化 — 從實驗到一級模型
MOA 的演進歷程
Mixture of Agents(MOA)功能首次在 v0.18.0「The Judgment Release」(2026 年 7 月 1 日)推出 [2]。在那個版本中,MOA 是一個可以切換的模式。到了 v0.19.0,MOA 已經升級為一個完全一級的模型提供者,每個命名的 MOA 預設都可以像選擇 Claude、GPT 或 Grok 一樣在模型選擇器中選擇 [1]。
MOA 的工作原理
MOA 是一個虛擬模型提供者,其核心思想是讓多個模型協同工作來解決複雜問題。根據官方文檔 [3],當選擇 MOA 預設時,Hermes 會執行以下步驟:
- 解析預設名稱:確定要使用的 MOA 預設配置
- 並行運行參考模型:運行配置的參考模型(不包含工具架構,只接收對話文本,以保持成本低廉)
- 上下文注入:將參考模型的輸出作為私有上下文附加給聚合器
- 聚合器調用:使用正常的 Hermes 工具架構調用聚合器模型
- 工具執行:如果聚合器調用工具,Hermes 正常執行這些工具
- 迭代重複:下一次迭代時,整個 MOA 流程在更新的對話上再次運行(包括工具結果)
這個設計的優雅之處在於,MOA 完全集成到 Hermes 的正常代理循環中,支持工具調用、後續迭代、中斷、轉錄持久性等所有標準功能。
MOA 的性能基準
官方文檔提供了 MOA 在 HermesBench 上的性能數據 [3]。一個由 Claude Opus 4.8 作為聚合器、GPT-5.5 作為參考模型的兩模型 MOA 預設的表現如下:
| 配置 | HermesBench 得分 |
|---|---|
| Opus 聚合器(opus-4.8 + gpt-5.5 參考)— MOA | 0.8202 |
| anthropic/claude-opus-4.8(單模型) | 0.7607 |
| openai/gpt-5.5(單模型) | 0.7412 |
MOA 配置比其最強組件(Claude Opus 4.8)提升了約 6 分,這表明聚合多個模型的視角確實能在困難任務上提升質量,而不僅僅是平均兩個模型的結果。
MOA 的實時可視化
v0.19.0 中,當 MOA 集合運行時,每個參考模型的完整輸出現在以自己的標記塊呈現——用戶可以看到 GPT-5 的思考、Claude 的思考、Grok 的思考,然後才看到聚合器綜合的答案。最終答案現在也實時流式傳輸到用戶,而不是在長時間沉默後一次性出現 [1]。這使得用戶能夠「看到委員會進行辯論,而不僅僅是讀到判決」。
MOA 配置示例
用戶可以通過多種方式配置 MOA 預設,包括 Dashboard、桌面應用、終端命令或 config.yaml。一個典型的配置示例如下 [3]:
moa:
default_preset: default
presets:
default:
reference_models:
- provider: openai-codex
model: gpt-5.5
- provider: openrouter
model: deepseek/deepseek-v4-pro
aggregator:
provider: openrouter
model: anthropic/claude-opus-4.8
max_tokens: 4096
enabled: true
此外,用戶還可以通過 reference_max_tokens 參數限制參考模型的輸出長度,以加快轉折速度。由於聚合器只需要每個顧問判斷的要點,一個適當的上限(例如 600 tokens)可以顯著減少每轉折的牆時間,同時對質量的影響很小 [3]。
第三部分:企業級功能與安全加固
終端訂閱管理
v0.19.0 引入了 /subscription 和 /topup 命令,讓用戶可以直接在終端管理他們的 Nous 訂閱計劃 [1]。用戶可以:
- 查看當前的訂閱計劃和剩餘配額
- 預覽升級的確切成本(例如「支付 $46.30 並立即升級」)
- 查看降級何時生效
- 應用更改,包括計劃更改橫幅和撤銷選項
這一功能消除了用戶必須訪問計費網站的需要,使得訂閱管理成為一個完全集成的終端內體驗。
密碼管理器集成
API 密鑰不再需要存儲在純文本的 .env 文件中。v0.19.0 引入了一個可插拔的 SecretSource 接口,允許 Hermes 在加載時從 Bitwarden 和 1Password 獲取密鑰 [1]。主要特性包括:
- 同時啟用多個保管庫
- 確定性優先級
- 衝突警告
- 每個變量的來源可追溯性
這個統一的接口將 11 個競爭的社區 PR 合併為一個協調的界面,未來的保管庫提供者可以作為插件添加。
子代理實時監控
delegate_task 調度現在返回實時轉錄文件,用戶可以在子代理啟動時立即 tail -f 查看 [1]。每個子代理都有一個人類可讀的日誌,記錄每個工具調用、結果和流式回應。此外,後台委派完成現在是持久的——如果進程在運行中重啟,結果會被恢復並通過一個所有權檢查的分類帳傳遞,而不是消失。
回應持久化與交付義務分類帳
如果網關在生成回應和確認平台實際傳遞之間崩潰,該回應曾經會被無聲地丟失(用戶仍需為該轉折付費)。v0.19.0 引入了「交付義務分類帳」,最終回應現在記錄在 state.db 中的平台發送周圍,並在下次啟動時重新傳遞 [1]。這解決了 Telegram、Discord、Slack 和其他所有渠道的 P1 級無聲損失窗口。
智能批准系統
當 Hermes 想要運行一個標記的命令時,LLM 審查器現在獨立評估它,而不是要求用戶批准每一個——每個判決只涵蓋那個確切的命令,所以稍後匹配相同模式的命令會獲得自己的審查 [1]。結合新的用戶定義拒絕規則(即使在 yolo 模式下也會阻止命令)和 /deny <reason> 命令(告訴代理為什麼拒絕以便它自我糾正),日常批准疲勞大幅下降,同時不犧牲控制。
第四部分:模型生態擴展
新增模型支持
v0.19.0 擴展了 Hermes 支持的模型列表,包括 [1]:
- Fireworks AI 和 DeepInfra 作為一級提供者(Fireworks 具有成本估計和提供者選擇器中的 #2 位置)
- GPT-5.6(Sol/Terra/Luna + Pro 變體)
- grok-4.5(GA)
- claude-fable-5 和 claude-sonnet-5
- moonshotai/kimi-k3
- Tencent HY3(GA)
- LM Studio JIT 模型加載(用於本地設置)
推理努力等級擴展
推理努力現在獲得了 max 和 ultra 級別(GPT-5.6 和 Codex 的頂級層),可在 CLI 到桌面的所有地方選擇,具有對提供者較小規模的合理限制 [1]。用戶還可以:
- 在 config 中固定按模型的推理努力覆蓋
- 在 MOA 預設中設置每個槽位的努力(顧問思考深入,綜合器保持快速)
- 為輔助模型設置按任務的努力
推理深度現在是一個可調節的旋鈕,而不是一個全局開關。
第五部分:開發者友好的功能
會話導出與數據所有權
hermes sessions export 現在支持多種格式 [1]:
- Markdown
- Quarto
- HTML
- 僅提示詞
- Hugging Face 就緒的跟蹤格式
導出具有完整的過濾表面(年齡、工作區、平台)、可選的 --redact 密鑰清理過程,以及壓縮的會話血統縫合到一個邏輯導出中。結合新的修剪過濾器和批量存檔,用戶可以保持會話存儲整潔。會話歷史現在是一個真實的數據集,而不是一個黑匣子。
多配置文件消息路由
一個共享一個 bot 令牌的多路複用網關現在可以將特定的 guilds、channels 或 threads 路由到不同的配置文件——每個都有完全隔離的配置、技能、記憶和密鑰 [1]。用戶可以將工作 Discord 服務器指向工作配置文件,將愛好服務器指向個人配置文件,都來自一個 bot。
第六部分:P0/P1 清零成就
v0.18.0「The Judgment Release」(2026 年 7 月 1 日)標誌著 Hermes 項目的另一個重要里程碑 [2]。在那個版本中,Nous Research 團隊在一週半的時間內專注於一個目標:解決整個 Hermes Agent 倉庫中的每一個 P0 和 P1 issue 和 PR。
| 優先級 | 已解決的 Issues | 已合併的 PRs |
|---|---|---|
| P0(關鍵) | 3 | 8 |
| P1(高優先級) | 493 | 188 |
| 總計 | 496 | 196 |
這代表在 12 天內解決了約 692 個最高優先級項目。該團隊承諾從此保持 P0/P1 數量為零。
第七部分:版本時間線與統計
近一週的版本發佈
| 版本 | 發佈日期 | 主要特性 |
|---|---|---|
| v0.19.0 | 2026/7/20 | Quicksilver Release – 性能革命、MOA 成熟化、企業功能 |
| v0.18.2 | 2026/7/7.2 | Infrastructure Patch – WhatsApp Baileys 依賴修復 |
| v0.18.1 | 2026/7/7 | Infrastructure Patch – ~660 PRs 的穩定版本 |
| v0.18.0 | 2026/7/1 | The Judgment Release – P0/P1 清零、MOA 首次推出 |
v0.19.0 統計數據
自 v0.18.0 以來 [1]:
- ~2,245 commits
- ~1,065 merged PRs
- ~2,465 files changed
- ~300,000 insertions
- ~36,000 deletions
- ~3,300 issues closed
- 450+ community contributors
結論
Hermes Agent v0.19.0 代表了開源 AI 代理框架的一個重要進步。性能的 80% 首 Token 時間改進使其成為一個真正可用於實時應用的平台,而 MOA 功能的成熟化將多模型協同工作從一個實驗特性轉變為一個生產就緒的功能。企業級特性(如訂閱管理、密碼管理器集成、子代理監控)和開發者友好的功能(如會話導出、多配置文件路由)進一步鞏固了 Hermes 在開源 AI 代理生態中的地位。
隨著 GPT-5.6、Claude Fable 5 等前沿模型的支持,Hermes 已經準備好利用最新的 AI 能力。對於尋求一個功能完整、性能優異、社區活躍的開源代理框架的開發者和組織來說,Hermes Agent 現在是一個更具吸引力的選擇。
參考資料
[1] Hermes Agent v0.19.0 (2026.7.20) — The Quicksilver Release – GitHub Releases
[2] Hermes Agent v0.18.0 (2026.7.1) — The Judgment Release – GitHub Releases
[3] Mixture of Agents | Hermes Agent – Hermes Agent 官方文檔
資料來源驗證:所有信息均來自 Nous Research 官方 GitHub Release 和官方文檔,已於 2026 年 7 月 21 日驗證。
本文由 Manus AI 撰寫,基於官方來源進行深度分析。