如果你已經訂閱了 X Premium,你就已經擁有 Grok。透過一次 OAuth 登入將其連接到 Hermes——不需要 API 金鑰——代理就能為你讀取 X、執行瀏覽器任務,並透過單一斜線指令執行多技能劇本。
這就是重點。本月推出了三項功能:X Search(含影片生成)、Browse.sh 和 Skill Bundles。這套技術堆疊不再只是研究工具,而是成為了一個真正的代理。以下是我機器上實際運行的內容。
Grok 應用程式 vs. Hermes 中的 Grok
Grok 在應用程式中還不錯,直到你關閉分頁。然後它就忘了你的存在。
Hermes 封裝了 Grok。相同的模型、相同的推理能力——但現在它能記住事情。上下文會累積。第 30 天的代理不同於第 1 天的代理,因為它一直在傾聽。這就是全部的賣點。
只使用 X vs. X + Hermes
| 任務 | 只使用 X | X + Hermes |
|---|---|---|
| 尋找內容 | 滾動瀏覽,碰運氣 | 代理按排程自動呈現 |
| 閱讀 X 文章 | 一次開一個分頁 | 自動拉取全文並摘要 |
| 監控帳號 | 靠你自己的記憶 | Cron 每日運行,自動去重 |
| 書籤 | 變成墳場 | 每夜摘要,含完整內容 |
| 跨天記憶 | 靠你自己(如果幸運的話) | 與過去的報告交叉比對 |
| 成本 | 你的時間 | 每天約 $0.10 |
X API 只能拉取 X 文章的標題和幾行內容。x_search 能讀取完整文章。這就是關鍵差異。
技術堆疊
Hermes(編排層)
├─ x_search → Grok 4.3 → X 帖文 + 完整文章內容
├─ Browse.sh → 透過 @browserbase 提供數百個瀏覽器技能
├─ Skill Bundles → 一個斜線指令,一個完整劇本
├─ 影片生成 → 文字/圖片轉影片,最多 7 張參考圖片
└─ 基礎模型 → DeepSeek v4(不是 Grok 4.3——它在多輪對話中表現不佳)
將 Grok 4.3 設為基礎模型你就會知道為什麼我浪費了兩個晚上。別這樣做。
三項最新超能力
01 · X Search
你的 X Premium 訂閱 = 你的 Grok 存取權 = 你的代理研究資訊來源。不需要 API 金鑰。任何 Grok 方案都適用,包括你已經在付費的 X Premium。一次 OAuth 登入後,Cron 就會監控你的帳號列表、讀取完整文章(不只是標題),並由 DeepSeek 進行優先排序。每天約 $0.10。沒有什麼好抱怨的。
注意:
x_search預設是關閉的。OAuth 登入後:hermes tools→ CLI → 開啟 X Search → 重新啟動。很多人都會漏掉這一步。
02 · Browse.sh
透過 @browserbase 提供數百個瀏覽器技能——可拉取或貢獻。瀏覽器代理過去總是壞在同一件事上:每個都從零開始重新發現網路、遇到同樣的驗證碼、在同樣的登入處失敗。技能重用解決了這個問題。可靠性來自技能目錄,而非模型本身。
真正的解鎖在於:Hermes 現在能在網路上完成工作流程。填寫表單、完成結帳、監控儀表板直到某件事觸發。這與「為你讀取 X」是完全不同類別的工具。
03 · Skill Bundles
一個斜線指令,整個劇本就開始執行。將相互串接的技能封裝起來——每個輸出都會餵給下一個。這裡的解鎖不在於新能力;而在於壓縮。當你擁有 20 個技能時,編排成本會主導運行成本。Bundles 解決了編排稅的問題。
影片生成,實戰演示
與 X Search 一同捆綁的是影片生成功能——文字/圖片轉影片,最多 7 張參考圖片。
提示詞:生成一段龍與猿戰鬥的短片
→ 8 秒。720p。渲染耗時 93.5 秒。
我實際運行的四個工作流程
1. 每日簡報。 Hermes 在背景運行,載入我的研究論點和偏好設定。每天早上:一份關於宏觀經濟、地緣政治、科技、AI 和加密貨幣的簡報。每份報告都會回饋到 Hindsight,所以簡報會越來越精準,因為它不會重複已經告訴過我的內容。大多數人不相信這點,直到親眼看到。
2. 帳號追蹤器。 四個我不會錯過的 AI 帳號:@gregisenberg、@milesdeutscher、@AlexFinn、@JulianGoldieSEO。Cron 每日運行。演算法沒有投票權。
3. 書籤摘要。 Cron 拉取過去 24 小時的書籤、去重、x_search 讀取完整文章,然後 DeepSeek 進行摘要。我的書籤不再是墳場了。
4. /post-maker。 我的 Skill Bundle 用於發布內容——一個指令按順序執行四個技能:
/post-maker 撰寫一篇關於為什麼 AI Skill Bundles 是遊戲規則改變者的文章
bundle 載入:
· concept-synthesis → 從筆記和 wiki 中提取觀點角度
· writing-plans → 草擬架構,而不只是大綱
· article-enrichment → 加入證據、範例和來源
· humanizer → 去除 AI 痕跡,強化個人語氣
在 Bundles 之前:五個獨立指令、五個獨立提示詞,每次切換都會流失上下文。現在:一行指令。輸出結果之所以連貫,是因為每個技能都能看到前一個技能做了什麼。這就是編排稅消失的樣子。
為什麼這能運作:線性組合。 每個技能的輸出餵給下一個。糟糕的 Bundles 會互相衝突(研究 + 外發 + 修錯一次性完成——代理選錯路徑、輸出偏離、你失去精準度)。好的 Bundles 是串接的。規則:把你每週執行超過兩次的工作封裝成 Bundle。頻率低於此的,保持分開。把每月只做一次的事情封裝起來,那是偽裝成生產力的開銷。
第一個月的轉變
你不再委派思考本身。你自己形成假設,然後用代理來測試它。Hermes 能捕捉你會遺漏的東西,將監控壓縮成一份簡報,並在新資料到來時記住三週前告訴你的內容。
它無法決定什麼重要。那仍然是你的工作。如果你把觀點也外包出去,那你就沒有觀點了。
你實際上在建立什麼
X 擁有資料。Grok 有存取權。Browserbase 擁有瀏覽器層。Hermes 是上層的編排。如果其中任何一層明天改變了條款,你的工作流程就會中斷。這不是悲觀——這是技術堆疊的現實。
你建立的是營運槓桿,不是護城河。一個代理以每月 $10 加上每天 $0.10 的成本處理即時的公共廣場資訊。有用。便宜。但不屬於你。
屬於你的是:你的研究論點、你的判斷、你的受眾、你的思維累積的 wiki。代理是租來的基礎設施。觀點才是資產。清楚知道你在租什麼就好。
自己動手試試
- 安裝:hermes-agent.nousresearch.com
- 瀏覽器技能:browse.sh
關注 @babyape113 以獲取更多來自技術堆疊內部的工作流程。保持好奇心。保持謙遜。理性投資。