v0.19.0 Quicksilver:第一個 token 快了八成,還能從終端機管訂閱
如果你之前覺得 Hermes 每次回答前都要「深呼吸」一下:盯著轉圈圈等好幾秒才看到第一個字:那口氣在這一版沒了。
2026 年 7 月 20 日發布的 v0.19.0(代號 Quicksilver),主軸就是速度1。Hermes 是信使之神,這一版讓他真的動得像信使。以下挑對中文使用者最有感的幾項講。
快了多少:第一個 token 砍掉約 80%
以前冷啟動那句「Initializing agent...」會吃掉大約 4.3 秒才輪到你的第一句話碰到模型;現在是約 0.9 秒2。這個提速對 CLI、gateway、TUI、桌面版、cron 全部生效,不是只有某一個介面。
除了「實際變快」,還處理了「感覺上的等待」:
- 推理模型現在預設即時串流思考過程:不再對著 spinner 發呆 30 秒,你看得到它在想什麼
- 回應框改成逐 token 繪製,不是逐行
桌面版另外做了 20 幾個針對性的效能修正:長回應的 markdown 拆分以前多花 14 倍 CPU、大型 diff 會凍住審閱面板、切換 session 會卡,這些都修掉了1。
從終端機直接管 Nous 訂閱
以前要開網頁才能看用量、儲值。現在有兩個新的斜線指令1:
/subscription:查看目前的訂閱狀態/topup:直接儲值
不用離開終端機。
智慧核准變成預設
以前每個被標記的敏感指令都要你手動點核准。這一版智慧核准(smart approvals)預設開啟:它會替你判斷被標記的指令該不該放行1。
📝 待驗證:智慧核准的判斷邏輯、以及怎麼調整或關掉它,官方 release notes 沒有展開。 用過的人幫我們補上這一段。
接上你的密碼管理器
新增 Bitwarden 和 1Password 作為 secret 來源1。這代表 API key、token 這類機密可以從你既有的密碼管理器取用,不用另外散落在設定檔裡。
即時看子代理工作
Hermes 會派子代理處理平行任務。這一版可以即時看到子代理的工作紀錄,而且背景委派變得更耐用:不會做到一半就不見1。
回答不會再弄丟
新增了「交付義務帳本」(delivery-obligation ledger):一個已經完成的回答,即使 gateway 當掉也不會遺失1。對於掛在 Telegram 這類平台、需要可靠送達的人,這是實質的可靠性提升。
新的模型供應商與模型
這一版接上了更多供應商與前沿模型3:
- 新供應商:Fireworks AI、DeepInfra
- 新模型:GPT-5.6(Sol / Terra / Luna / Pro)、Claude Sonnet 5 完整接好
另外可以把你不用的供應商藏起來,讓 hermes model 選單清爽一點。
推理強度可以調到最大
新增了推理強度(reasoning effort)的分級,而且可以逐模型控制1。需要模型想深一點的任務,現在有更明確的旋鈕可以轉。
還有一個小而實用的 /model --once:只對這一次對話換模型,不改預設。
你的資料是你的:全部匯出
新增了完整匯出功能1。你的 session、資料都能匯出帶走。
這一版對你既有的設定有影響嗎
大多數是新增功能與提速,不需要你改動現有設定。但有兩點值得注意:
- 智慧核准變成預設:如果你習慣手動核准每個指令,行為會不一樣,留意一下
- 這一版也把 v0.18.1、v0.18.2 兩個基礎設施修補版一起收進來了1
如果你在這一版之後發現本站某篇教學的指令或說明對不上,那正是需要更新的訊號:回報給我們。
下一步
- 上一版做了什麼 → v0.18.0 Judgment
- 還沒安裝 → 安裝部署
- 想調模型與推理設定 → 模型供應商與 API key 設定
- 看更多官方 issue 討論 → 官方 issue 中文精選
Footnotes
-
Nous Research, Hermes Agent v0.19.0 (v2026.7.20):The Quicksilver Release:https://github.com/NousResearch/hermes-agent/releases/tag/v2026.7.20 (2026-07-24 存取) ↩ ↩2 ↩3 ↩4 ↩5 ↩6 ↩7 ↩8 ↩9 ↩10
-
同上,Highlights:冷啟動 ~4.3s → ~0.9s,約 80% TTFT 降幅(PR #59332、#59389) ↩
-
同上,Highlights:新增 Fireworks AI、DeepInfra 供應商,以及 GPT-5.6、Claude Sonnet 5 ↩