當多數 AI 工具還停留在「打開網頁、發送 Prompt、複製貼上回答」的單次交談時,具有持久雲端電腦(Persistent Cloud Computer)的 Agent 已經把工作方式推向了另一個維度。
xAI 釋出的 Grok Bot Guides 官方手冊收錄了 17 篇由內部工程師、DevRel 與產品經理撰寫的落地實務。從 Matt Palmer 的〈Grok Bot 101〉與〈Templates for Grok Bot〉,到跨工程、銷售、法律與產品的具體操作,這份手冊呈現的不僅是 Prompt 技巧,而是一套嚴謹的多 Agent 組織與工程控制面。
本文作為《Grok Bot Guides 三部曲》的第一篇,專注提煉這 17 篇手冊背後共通的架構基石:執行迴路如何解耦、多 Bot 在共用電腦下的信任邊界,以及知識資產如何透過 Template 封裝與流通。
雙環架構:Outer Loop 治理與 Inner Loop 執行
在〈Grok Bot 101〉與〈Grok Bot for Engineering〉中,最關鍵的架構轉折是Outer Loop(外環治理)與 Inner Loop(內環執行)的明確分工。
許多團隊嘗試讓單一 Agent 承擔所有工作:讀取需求、翻找內部 Slack 討論、查詢 Notion 文件、分析程式碼庫、撰寫修改、執行測試並開啟 Pull Request。這種做法往往導致 Context Window 迅速被無關的雜訊塞滿,最終在寫程式時發生注意力漂移或幻覺。
Grok Bot Guides 給出的標準架構是徹底分開兩個迴路:
外環管理平面(Outer Loop)
- 承載實體:Grok Bot。
- 職責邊界:負責整合髒亂的上下文。它在雲端電腦中長駐,穿梭於 Slack、Notion、GitHub Issues 與內部 Wiki,將零散的業務背景與多方討論提煉為清晰、具體且具備驗收條件的任務契約(Task Contract)。
- 關鍵原則:Outer Loop Agent 本身不直接撰寫核心程式碼。它的任務是產生高品質的提示詞與規格,正如資深工程主管為團隊擬定架構與邊界。
內環執行沙盒(Inner Loop)
- 承載實體:Cursor Cloud Agent 或專屬 Coding Harness。
- 職責邊界:在乾淨、隔離的運算容器內啟動。它接收 Outer Loop 遞交的純淨 Prompt 與既定測試套件,專注於讀寫檔案、執行靜態分析、跑綠測試並開啟 PR。
- 關鍵原則:執行完畢後立即產出 diff、測試日誌與驗收截圖,將結果回傳給 Outer Loop 審查。
這種解耦確保了內環執行的可重現性,更讓人類主管能將精力聚焦在 Outer Loop 的邊界審查上。
共享電腦邊界:角色分工不是安全隔離
在導入多 Bot 協同作業時,最常見的安全盲區是誤將「Bot 角色」視為「沙盒邊界」。
xAI 在官方手冊與安全文件中反覆強調一項工程事實:同一個使用者帳號下的所有 Grok Bot,共用同一台持久雲端電腦、同一個檔案系統、相同的瀏覽器 Session 與登入憑證。
這意味著:
- Context 隔離不等於安全隔離:你為研究競品建立的「Scout Bot」與讀取財務報表的「Finance Bot」,在後台其實共用相同的本機 Cookie 與瀏覽器狀態。
- 分工的真正價值是注意力控制:將工作拆分給 5 個專業 Bot(例如 Coder、Researcher、Writer),目的是為了維持專屬的 Prompt 邊界與有限記憶,防止上下文污染,而不是為了防止權限穿透。
- 敏感憑證的交接原則(Session Handoff):當流程需要輸入密碼、Passkey、2FA 驗證碼或信用卡付款時,系統不可在對話中要求明文金鑰,而是暫停執行並將雲端螢幕控制權交還給人類,完成驗證後再繼續執行。
- 自然語言審查閘門:Grok Bot 透過獨立的 Reviewer Agent 監控底層指令,並依據設定的 Allow/Block 規則判定是否需要人類確認(Require Approval)。這層防護是模型語義級別的守門,而非傳統 OS 等級的硬體虛擬化隔離。
Template 機制:封裝食譜,而非複製成品
知識工作者如何在團隊或社群中流通自己調教出的優質 Bot?〈Templates for Grok Bot〉給出了一個生動的比喻:Template 是一份食譜(Recipe),而不是一份煮好的餐點(Meal)。
當你點擊「Share as Template」時,系統會建立一份藍圖複本,其打包與過濾行為具有嚴格的邊界:
藍圖封裝項目
- 核心指令(Instructions):Bot 的職責定義與決策邏輯。
- 通用記憶與經驗(Relevant Memories):沉澱下來的架構原則與慣例。
- 擴充技能(Skills & Plugins):第一方整合外掛與標準自動化定義。
- 例行排程(Routines):定時執行或事件觸發條件。
自動剝離與安全保護
- 私密記憶與個資:自動排除使用者個人或專屬私密記憶。
- 敏感憑證與自訂環境:客製腳本、本機自架 MCP Server 與 API Key 不會被打包進 Template。
- 接收端的環境再就緒:安裝 Template 的使用者會獲得全新的獨立 Bot 複本,但必須自行重新授權 Plugin 與補齊專屬的 MCP 服務連線。
這項設計兼顧了知識資產的流通性與跨組織分享時的資料安全性。
組織與專案控制面的下一步
理解了「雙環架構」、「共享電腦信任邊界」與「Template 封裝契約」,我們就擁有了評估與設計多 Agent 系統的核心心法。
在《Grok Bot Guides 三部曲》的後續兩篇中,我們將進一步深入具體領域:
- 第二部:工程與研發閉環:探討如何以專職 Bot 艦隊管理 200 個 Cloud Agents、打造獨立手機遊戲工作室,以及設計師如何讓 Agent 在真實專案資產中協同演進;
- 第三部:團隊協同與 GTM 組織:解密「一專案一頻道一看板」的六人 Bot 編制法,以及產品經理、創辦人與銷售團隊如何將日常瑣事昇華為全自動化推進流水線。
