v0.18.0 Judgment:它學會證明自己做完了,而不是說自己做完了
AI 助手最讓人不放心的一句話是「我已經修好了」。你得自己去跑一次才知道是不是真的。
2026 年 7 月 1 日發布的 v0.18.0(代號 Judgment) 就是在處理這件事:讓 agent 用證據判斷自己完成了沒有,而不是憑感覺宣告成功1。以下挑對中文使用者最有感的幾項講。
全 repo 的 P0 / P1 一次清到零
這一版的頭條不是功能,是把積欠的高優先問題清乾淨。官方公布的數字2:
| 優先級 | 關閉的 issue | 合併的 PR |
|---|---|---|
| P0(致命) | 3 | 8 |
| P1(高) | 493 | 188 |
| 合計 | 496 | 196 |
十二天內處理掉約 692 個最高優先項目,清完的那一刻整個 repo 的未解 P0 與 P1 是 0。官方宣告從此把 P0 / P1 維持在零。
這個數字對你的意義:如果你之前遇到某個明顯的 bug 卻一直沒被處理,這一版值得回頭確認一次。
「做完了」改成要拿證據
Hermes 現在會為程式工作記錄驗證證據,並且透過實際執行你專案的檢查來判斷是否完成,而不是靠模型自己說3。
/goal 新增了完成契約(completion contracts):你先講清楚「做完」長什麼樣,常駐目標迴圈就依證據判定,而不是模型覺得差不多了就停。另外提供 pre_verify hook 讓你接自訂檢查。
官方原文把差別講得很直白:「the difference between "I think I fixed it" and "the tests pass, here's proof."」(「我覺得我修好了」與「測試通過,證據在這」的差別。)
📝 待驗證:完成契約的實際寫法與
pre_verifyhook 的設定範例,官方 release notes 沒有給完整範例。 用過的人幫我們補上這一段。
注意一個預設值:verify-on-stop 預設是關閉的,並帶一次性的 v32 遷移,純文件編輯會跳過驗證3。
/learn:一句話把流程變成技能
/learn <任何東西>
指向一個目錄、一個網址,或就是你五分鐘前帶著它走過的那套流程,Hermes 會把它蒸餾成一個可重複使用的技能,並且自動遵照你 CONTRIBUTING.md 裡的技能撰寫標準4。
以前教它一個新招式要手動寫技能檔,現在是一個指令。這件事跟技能系統講的「agent 自己長出技能」是同一個機制的手動觸發版本。
/journey:看見它到底記得你什麼
CLI 與 TUI 新增 /journey,一條學習時間軸,列出 Hermes 累積下來的記憶與技能,而且可以就地編輯或刪除任何一條5。
桌面版另外做了記憶圖譜,把記憶與技能畫成一個由上而下、可播放的放射狀時間軸5。
這兩個東西合起來解決同一個問題:agent 的記憶不再是黑盒子。你看得到它學了什麼、看著它長大,也能把記錯的剪掉。想理解底層機制見記憶系統。
多模型合議變成可以直接選的模型
Mixture-of-Agents(MoA,多代理混合)以前是一個要切換的模式,這一版變成一等公民6。
每個具名的 MoA 預設會以 moa 供應商底下的模型出現在所有模型選單裡(CLI、TUI、桌面版、gateway),跟 Claude、GPT、Grok 並列。你選「my-council」的方式,跟選任何一個模型完全一樣。
而且每個參考模型的完整輸出會各自渲染成標了名字的區塊:你可以先讀 GPT-5 怎麼想、Claude 怎麼想、Grok 怎麼想,再看聚合模型把它們綜合成一個答案,而那個最終答案現在是即時串流的,不是沉默很久之後一次跳出來6。
/moa 改成一次性用法,跑完會把模型還原;要長期切換走模型選單。
委派一堆工作然後繼續做別的
delegate_task 現在可以一次散出多個在背景跑的子代理,你的對話完全不會被卡住,全部跑完之後結果會合併成一個回合回來7。
「同時研究這五家競品」或「稽核這三個模組」丟出去,你去忙別的,最後拿到一份乾淨的整合摘要,不必一個一個顧。
自我改良變便宜了
每個回合結束後那個「要不要存成記憶或技能」的背景判斷,改成路由到輔助模型、只讀上下文摘要而不重播整段對話,而且會自己調整執行頻率8。
結果是自我改良的功能留著,但你不用再用主要模型的價格去付這筆錢。
其他值得知道的
/prompt用你的編輯器寫長提示詞:開$EDITOR寫真正的 markdown,存檔後排進下一則訊息9- Google Vertex AI 成為一等供應商:透過 Vertex 的 OpenAI 相容端點用 Gemini。以前用一般自訂供應商設定會在對話中途死掉,原因是 Vertex 沒有靜態 API 金鑰,每個請求都要用服務帳戶 JSON 或 ADC 換一個約一小時效期的 OAuth2 token。Hermes 現在會自動換發與續期10
- 桌面版有了正式的「專案」:每個 profile 一份程式庫側邊欄、程式碼軌道、審閱面板、git worktree 管理11
- gateway 可以縮到零:閒置時休眠,重啟或自動更新前乾淨排空,不會切斷進行中的對話12
這一版對你既有的設定有影響嗎
- verify-on-stop 預設關閉,並附一次性 v32 遷移。想要「做完必驗證」要自己開
/moa語意改變:從切換模式變成一次性執行,長期切換請改走模型選單- 安全更新一批:MCP 設定持久化的攻擊面、可外洩供應商憑證的 cron
base_url覆寫、Slackxapp-token 遮蔽、瀏覽器雲端 metadata 底線,以及aiohttp的 CVE 版本下限13。建議更新
下一步
- 上一版做了什麼 → v0.17.0 Reach
- 下一版做了什麼 → v0.19.0 Quicksilver
- 想理解技能怎麼長出來 → 技能系統
- 想調模型設定 → 模型供應商與 API key 設定
Footnotes
-
Nous Research, Hermes Agent v0.18.0 (v2026.7.1):The Judgment Release,2026-07-29 存取:https://github.com/NousResearch/hermes-agent/releases/tag/v2026.7.1 ↩
-
同上,「The P0/P1 Clean Sweep — 100% resolved」章節的優先級表格與十二天、約 692 項的敘述 ↩
-
同上,Highlights 與「Verification & Goals」章節(PR #50501、#52285、#55413、#53552) ↩ ↩2
-
同上,Highlights:「
/learn— turn anything into a reusable skill by describing it」(PR #51506、#52372) ↩ -
同上,Highlights:「
/journey— a playable timeline of everything Hermes has learned about you」(PR #55555、#55859、#55226) ↩ ↩2 -
同上,Highlights 與「Mixture-of-Agents (MoA)」章節(PR #46081、#53548、#53561、#53793、#53855、#55625) ↩ ↩2
-
同上,Highlights:「Delegate a pile of work and keep going — background fan-out」(PR #49734) ↩
-
同上,Highlights:「Cheaper self-improvement — smarter background review」(PR #49252) ↩
-
同上,Highlights:「Compose your next prompt in your editor —
/prompt」(PR #50509) ↩ -
同上,Highlights:「Google Vertex AI — Gemini through your GCP service account, no static key」(PR #56363) ↩
-
同上,Highlights:「First-class coding Projects in the desktop app」(PR #49037、#54385、#54517) ↩
-
同上,Highlights:「Run Hermes at scale — scale-to-zero and drain coordination」(PR #52243、#52937、#54824) ↩
-
同上,Highlights:「Security round」(PR #50476、#56196、#54166、#56227、#52349、#56237) ↩