長運行 Agent

Managed Agent:腦手分離

核心洞察:把 Agent 的思考和執行拆成獨立組件,讓系統在任何部分出錯時都能優雅恢復。

類比:操作系統的虛擬化
操作系統虛擬化硬件
當你調用 read() 時,你不關心底層是 SSD、HDD 還是網絡磁盤,操作系統幫你抽象了硬件細節。
Managed Agent 做同樣的事:虛擬化 Agent 的各個組件,讓腦不關心手是哪個容器,讓手不關心腦用的是哪個模型。
三個核心組件
Session
會話日誌
Append-only 的事件流,持久化存儲。記錄所有發生過的事情:用戶輸入、工具調用、模型輸出。
Harness
腦 / 大腦
調用 Claude 並路由工具調用的循環。負責思考:決定下一步做什麼、如何組織上下文。
Sandbox
手 / 沙箱
執行程式碼和編輯檔案的容器環境。負責執行:運行命令、寫檔案、與外部系統互動。
為什麼要拆開:寵物 vs 牛羣
架構演進
舊方案(寵物)
Session + Harness + Sandbox 都在同一個容器裏。

容器掛了 = 會話丟失 = 無法調試 = 任務徹底失敗。

就像養了一隻寵物,掛了就完了,無法替代。
新方案(牛羣)
每個組件獨立部署,互不依賴。

容器掛了 = 工具調用失敗 = Claude 決定重試 = 新建容器繼續。

就像牧場的牛,掛了重來一個,系統照常運行。
動手試試:故障恢復模擬
Harness
Brain(腦)
Sandbox
Hand(手)
Event Log
Session(會話)
點擊下方按鈕,觀察不同故障場景下系統的恢復行為。
腦離開容器後的好處
關鍵改進
-60%
TTFT p50 降低
-90%+
TTFT p95 降低

TTFT = Time to First Token(首 Token 響應時間)

安全的結構性解決
安全問題的架構級解決
多腦多手
組件可以自由組合
Brain A
Brain B
Brain C
多個 Brain:各自只是無狀態 Harness,按需啓動
Sandbox 1
Sandbox 2
Sandbox 3
Sandbox 4
多個 Hand:各自是獨立工具,可以傳遞給不同 Brain

這意味着你可以讓一個 Brain 同時操控多個 Sandbox(並行執行),也可以讓同一個 Sandbox 在不同的 Brain 之間傳遞(接力執行)。組件之間完全解耦。

好的架構讓組件可以獨立失敗和獨立替換。腦手分離不只是性能優化,它從根本上改變了系統的可靠性模型:從「一隻寵物掛咗就全完」到「任何部分都能重建」。