大多數 AI 代理人等你打字才回應。Hermes 做到了其他人都做不到的事:它在夜間變得更聰明。從晚上 11 點到早上 8 點,一套正確配置的系統會監控系統、吸收知識、完成排程工作、優化自身技能,並在晨間將簡報送達你的 Telegram——每月基礎設施成本僅 7–30 美元。
本指南逐時解析完整的 9 小時循環、使其運作的基礎設施、你醒來後該檢視什麼、如何排除故障、保護無人值守操作安全的安全層級,以及實際的第一天到第一個月時間表。所有細節均經 Hermes Agent v0.16.0「The Surface Release」(2026 年 6 月 5 日)文件驗證。
為什麼「在你睡覺時」不是行銷話術
大多數代理人是被動的——你打字、它回應,其餘時間閒置。Hermes 的架構不同。三個特性讓隔夜操作成為現實:
- 持久閘道器進程 — 作為系統服務運行,永不休眠
- 帶有 60 秒 tick 的 Cron 守護進程 — 執行排程工作
- 自我改進循環 — 在完成任務後優化技能
這是具體的基礎設施針對具體資料執行具體任務,不是「假裝在夜間工作的 AI」。
24 小時時間軸
23:00 — 工作階段關閉
你最後的對話結束,工作階段乾淨關閉。SessionDB 持久化對話狀態。記憶循環掃描當天的交談,提取持久性事實,寫入 MEMORY.md 和 USER.md(分別限制在約 800 和 500 個 token)。
23:30 — 自我改進循環
已完成的任務會在背景分叉中被審查。有效的模式會被儲存為 ~/.hermes/skills/ 中的技能。代理人不會通知你——你醒來時會發現技能庫裡有了新的程序。(這是 Hermes 並行運行的 8 個嵌套循環中的第 3 個。)
00:00 — 管理者檢查
每 7 天,Curator 會在工作階段之間喚醒,掃描 ~/.hermes/skills/,識別冗餘或過時的程序,並將未使用的技能歸檔到 .archive/(可恢復)。透過 Hub 安裝的技能不受影響,因此技能庫無需手動維護就能保持整潔。
02:00 — 競爭情報 Cron
一個 cron 任務觸發 Python 腳本,抓取競爭對手的定價頁面,並與上週的快照做差異比對。如果沒有變化:{"wakeAgent": false}——零 LLM token 消耗。如果有變化,代理人會喚醒,讀取差異,將摘要寫入你的 wiki,並草擬一則 Telegram 警報等你早上查看。
03:00 — 知識吸收
LLM Wiki 吸收 cron 開始運行。Hermes 內建了一套基於 Andrej Karpathy LLM Wiki 模式的 llm-wiki 技能:一個由相互連結的 markdown 檔案組成的自我改進知識庫。與 RAG(每次查詢都重新發現知識)不同,Wiki 只編譯一次知識並保持更新——交叉引用保持連結,矛盾會自動標記。Cron 從觀察資料夾拉取你白天儲存的文章,將它們索引到你的 Obsidian 相容 Wiki 中,並更新受影響的頁面。在 ~/.hermes/.env 中設定 WIKI_PATH(預設為 ~/wiki)。
04:00 — 排程報告
每週績效審查、每月帳單摘要和每日正常運行時間報告。大多數使用 no_agent 模式(純 Python 腳本,零 LLM 成本)。輸出透過閘道器 REST 端點串流到 Telegram 或 Slack。
06:00 — 晨間簡報準備
一個 cron 任務組裝你的簡報——隔夜 cron 結果、Kanban 看板狀態、新的 Wiki 條目、頂部行事曆項目、任何被標記為緊急的項目。這份草稿透過代理人處理,因為它需要推理能力。
07:00 — Kanban 分派器
分派器整晚每 60 秒運行一次:偵測殭屍任務、追蹤心跳、管理重試預算。任何處於「Ready」狀態的任務都會被分配給可用的工作節點。
08:00 — 簡報送達
你的 Telegram 響起:最多 5 個要點——隔夜發生了什麼變化、哪些需要關注、行事曆上有什麼、以及本月至今的 token 消耗。你倒杯咖啡,閱讀簡報,決定什麼重要。
你早上該檢視什麼
隔夜自動化的全部意義在於讓早晨變得簡短——五個介面,總共 7–10 分鐘。
- Telegram 簡報(2 分鐘) — 前 3 個緊急項目、需要決策的隔夜變化、行事曆重點、本月 token 支出、任何觸發
wakeAgent的項目。回覆即可立即行動。 - Kanban 看板(2 分鐘) —
hermes dashboard → Kanban。掃描四個欄位:Blocked(需要你的輸入,優先處理)、In Progress、Ready、Done。你移到 Ready 的任何項目都會在 60 秒內被接手。 - 新技能審查(1–2 分鐘) —
hermes skills --new列出過去 24 小時內建立的技能。對每個技能問:它準確嗎?應該自動運行還是需要審批?壞的技能如果你不及時發現,會被重複使用。 - Wiki 新增項目(1–2 分鐘) —
ls ~/wiki/*.md -lt | head。瀏覽新條目、代理人提出的矛盾、以及大到需要建立父頁面的主題。 /usage檢查(30 秒) — 今天、本週、本月的 token 支出,與預算做比較。
早晨快捷指令
在你的 SOUL.md(或作為一個技能)中設定自訂的 /morning 指令,一次執行所有五項檢視並輸出一份精簡摘要。定義一次,每天使用。大多數日子這只需 7–10 分鐘;遇到需要認真關注的狀況則需 15–20 分鐘。
支撐这一切的基礎設施
五個持久運行的元件:
- 全天候運行的 VPS 或本地機器 — Hetzner CX22(約每月 7 美元)就能負荷。本地 Mac Mini 也可以,但停電時會中斷。
- 作為系統服務的閘道器 — 透過 systemd(Linux)、launchd(macOS)或 Hermes 的安裝服務模式運行,能在重啟後存活。
- Cron 守護進程(60 秒 tick) — 內建於閘道器中,觸發排程任務。
- 持久儲存 —
~/.hermes/儲存工作階段、記憶、技能和 Kanban 資料庫,重啟後不受影響。備份就是檔案複製。 - 至少一個通訊平台 — Telegram 設定最快;Discord 和 Slack 運作方式相同。
Desktop 應用程式改變了晨間工作流程
v0.16.0「The Surface Release」推出了一款原生 Electron 應用程式,支援 macOS、Linux 和 Windows。對於「在你睡覺時」的設定,它可以連接到遠端 Hermes 閘道器(你的 VPS 全天候運行;Desktop 應用程式透過 OAuth 或使用者名稱/密碼連接到相同的記憶、技能和工作階段),在不同分頁中運行並行多配置工作階段,無需 SSH 到 VPS 即可在應用程式內自我更新,以及拖放檔案回聊天中進行分析。Desktop 應用程式是一個控制介面——它不會取代你 VPS 上的閘道器。
如何正確設定「在你睡覺時」模式
大多數隔夜問題來自設定選擇,而非運行時的操作。五個配置可以在問題發生前預防它們。
1. 在第一次 cron 觸發前設定硬性 token 上限
budget:
daily_max_usd: 10
session_max_usd: 2
monthly_max_usd: 200
代理人在達到上限時會停止。在建立 cron 任務之前就設定好,以免收到意外帳單。
2. 為每個監控 cron 使用 wakeAgent
預設將監控任務設為 wakeAgent 模式而非完整的代理人運行——腳本免費偵測變化,代理人在真正發生變化時才啟動。
/cron add "every 1h" \
--script check-something.py \
--prompt "[only runs if script says wakeAgent: true]"
經驗法則:如果一個 cron 任務每小時運行超過一次,就應該有 wakeAgent 門檻。
3. 在讓代理人存取檔案前設定檢查點
checkpoints:
enabled: true
max_snapshots: 20
max_file_size_mb: 10
retention_days: 7
代理人在變更前對你的目錄做快照;/rollback 可以恢復狀態。如果沒有啟用檢查點,你就無法撤銷代理人在夜間所做的操作。
4. 在啟用自主性之前將限制寫入 SOUL.md
SOUL.md 的限制區段是你的防線——而且它必須具體。模糊的規則(「小心處理我的資料」)會被忽略;具體的規則才會被遵循:
## Restrictions
Never deploy to production without me approving the diff.
Never run `rm -rf` or destructive commands.
Never spend more than $5 on a single API call.
Never send messages to anyone except via my approved channels.
Never modify files outside ~/projects/ without confirmation.
Never push to a git remote autonomously.
5. 為敏感配置設定智慧審批模式
safety:
approval_mode: smart
redact_secrets: true
智慧模式使用輔助模型來分類風險。有風險的操作會帶著「批准/拒絕」按鈕出現在 Telegram 上,讓你在重要決策上保持控制,同時代理人處理日常工作。
設定順序很重要
按以下順序執行設定以避免昂貴的錯誤:
- 第 0 天: 安裝 Hermes,撰寫帶有限制的
SOUL.md,設定預算上限,啟用檢查點 - 第 1 天: 連接 Telegram,用手動任務測試(還不加 cron)
- 第 2 天: 加入一個簡單的 cron 任務(晨間簡報)
- 第 3–7 天: 確認它能平穩運行一週
- 第 2 週: 加入帶有
wakeAgent門檻的監控 cron - 第 3 週起: 根據實際效果擴展
最昂貴的錯誤發生在人們跳過第 2–7 天、第一天就建立 10 個 cron 任務的時候。從小開始,驗證後再擴展。
隔夜故障排除
實際設定中最常見的五個問題及修復方法。
「簡報沒有送達」 — hermes gateway status。如果閘道器在夜間崩潰,透過代理人組裝訊息的 cron 會靜默失敗。修復方法:將閘道器設定為 systemd/launchd 服務,使其自動重啟。
「Cron 觸發了但什麼都沒發生」 — hermes cron list 和 hermes logs --since 12h。常見原因:腳本逾時(預設 120 秒)、wakeAgent 門檻在應該回傳 true 時回傳了 false、或 API 金鑰過期(hermes doctor)。
「代理人做了我沒預期的事」 — /rollback 恢復上一個檔案檢查點(/rollback 3 回退三個)。然後更新 SOUL.md 限制以防止下次再發生。
「Token 支出遠高於預期」 — /usage 和 hermes prompt-size。常見原因:SOUL.md 變得太大(每輪都要付費)、某個 cron 設為 wakeAgent=true 但應該是 false、或子代理人委派過深(每個子代人都有獨立的工作階段成本)。
「Kanban 任務卡在 Running」 — 分派器每 60 秒偵測一次殭屍任務,但你可以用 hermes kanban reclaim <task_id> 手動回收,或用 hermes kanban pause / resume 暫停以進行調查。
Telegram、Slack 或 Discord
三個平台使用相同的閘道器、指令和 cron 推送——選擇你的團隊已經在用的就好。
- Telegram(最快):
hermes gateway setup→ 選擇 Telegram → 訊息 @BotFather →/newbot→ 貼上 token。最適合獨立創辦人和以手機為主的工作流程。 - Slack(最適合團隊): 在 api.slack.com/apps 建立應用程式,安裝到工作區,貼上 token。用
--deliver slack:#engineering或--deliver slack:@username推送到頻道。 - Discord(最適合社群): 在 discord.com/developers 建立應用程式,貼上機器人 token,邀請到你的伺服器。代理人甚至可以加入即時語音通話。
單一 cron 任務可以扇出到多個平台——代理人產生一份回應,兩個平台都會收到:
/cron add "every day 8am" \
--prompt "Morning brief" \
--deliver telegram \
--deliver slack:#ops
安全性:保護安全的五個層級
代理人在你睡覺時運行,所以保護比你想的更重要。五個層級:
- SOUL.md 限制 — 在自主運行期間,硬性規則就是硬性規則,載入時會被掃描以防提示注入。
- 審批門檻 —
approval_mode: smart加上redact_secrets和browser_private_urls將有風險的操作送到你的首頁頻道,附帶「批准/拒絕」按鈕。 - 檢查點 — 檔案變更前的目錄快照意味著
/rollback總能恢復狀態。 - Token 預算上限 — 硬性的
daily_max_usd/session_max_usd意味著失控的 cron 最多花 $X,不會到 $X+1。 - Docker 或 VPS 隔離 — 在容器或獨立 VPS 中運行,將爆炸半徑限制在你掛載的範圍內。
這些機制共同使隔夜自主操作變得安全到可以實際使用。沒有它們你會帶著擔憂醒來;有了它們你會帶著好奇心醒來。
實際時間表
複利效應是真實的,但在正常時間表上是可以衡量的。
| 階段 | 你的成果 | 感受 |
|---|---|---|
| 第 1 天 | 閘道器 + Telegram、1–3 個 cron、空白的技能庫和 MEMORY.md、初始版 SOUL.md | 基本的簡報。有用但不令人印象深刻——代理人還不怎麼了解你。 |
| 第 2 週 | 5–10 個 cron、8–12 個自建技能、MEMORY.md 含 1500–2000 字元、Wiki 含 20–50 條目 | 簡報開始引用你的專案和截止日期。第一次「嗯,這真的不一樣」的時刻。 |
| 第 1 個月 | 12–15 個 cron、20–30 個技能、完整的記憶 + 完善的 USER.md、Wiki 含 100–200 個交叉引用條目、Curator 已修剪 5–10 個過時技能 | 簡報浮現你沒注意到的模式;代理人建議你沒想到要加的 cron。 |
第 30 天的代理人能做出第 1 天的代理人做不到的決策——同樣的模型、同樣的設定,不同的輸出品質,因為系統累積了上下文。
實際隔夜成本
典型設定的 token 計算:約 5 個 wakeAgent cron 整夜運行(大多數在 wakeAgent: false 時觸發,零 LLM 成本),1–2 個因實際變化而觸發(每次 5–15K token),晨間簡報生成(10–20K token),以及背景自我改進工作。
- 實際隔夜 token 消耗: 30–60K token
- 按 Claude Sonnet 定價: 每晚約 $0.20–0.40
- 按 GPT-5.5 透過 Codex(包含在內): $0
- 加上 VPS: 每月約 $7 → 基礎設施總成本 $7–25/月
做同樣工作的虛擬助理每月要花 $500–2000。
設定清單
通往「在你睡覺時」模式的六個步驟:
- 部署一台 VPS(Hetzner CX22,約每月 7 美元)
- 透過一鍵安裝腳本安裝 Hermes
- 執行
hermes setup --portal以最快取得模型 + 工具 + 閘道器 - 撰寫
SOUL.md並明確限制 - 連接 Telegram 作為你接收簡報的首頁頻道
- 加入 3 個初始 cron 任務——晨間簡報、競爭對手掃描、每週審查
這讓你到達第 1 天。第 2 週透過使用它來實現。第 1 個月因為系統持續運行而實現。
複利的關鍵
「在你睡覺時」不是噱頭的原因:每個隔夜循環都為下一個循環添加了可用的東西。昨天建立的新技能加速了下週的任務。今天早上的記憶條目優化了明天的簡報。週二的 Wiki 條目在週四發現了一個矛盾。一個被動的 AI 工具每次對話都會重置——Hermes 什麼都不重置。第 30 天的狀態是第 1–29 天微小且大多不可見的改善累積結果。這就是「與你一起成長的代理人」在實踐中的意義。
作者 YanXbt。他的文章擴充版本發表在 Substack。所有技術細節均經 Hermes Agent v0.16.0「The Surface Release」(2026 年 6 月 5 日)文件驗證。