053 · 打造分身部隊的開發心法
這場 workshop 記錄講者如何用 OpenClaw、cmux 與 Agent Orchestrator 串起多重 agent 分工,並拿捏授權與監督的分寸。
原標題:Develop at Idea Velocity - Jeffrey Lee-Chan, Snapchat
重點摘要
- 決策要圍繞 spec,而非程式碼講者用 OpenClaw 統籌任務,讓每個決策依據任務的 spec、目標與對話歷史,實際寫碼再交給下游的 Claude Code 處理,避免 context 被程式碼細節占滿。
- 控制程度依任務調整從自己 fork 的開源框架 Agent Orchestrator,到用 cmux 終端機盯著每個 worker,講者依情境切換「放手讓系統跑」與「自己盯著看」的程度。
- 管理者視角能減少偏誤親自寫碼時容易高估進度,但用「管理者」身分檢視多個 worker 的產出,反而能看出某個 PR 其實該被另一個 PR 取代。
- 測試該不該用瀏覽器要分層判斷能靠 MCP/HTTP 驗證的邏輯就不必動用瀏覽器,只有真正需要視覺確認的部分才跑瀏覽器測試;講者觀察到 agent 處理瀏覽器操作的能力這半年到一年進步很快。
- 成本與可靠度要權衡講者說明何時值得為了可靠度啟用 sandbox 或 staging 環境,也提到主力模型吃緊時會切換到 MiniMax 控制 token 花費。
時間軸
時碼點下去會跳到影片的那一段。
| 時碼 | 段落 | 重點 |
|---|---|---|
| 00:00 | 開場安排 | 講者說明這場是工作坊:協助新手安裝 OpenClaw,同時讓進階者嘗試還沒完全穩定的 staging 環境,中間會穿插數次 Q&A。 |
| 01:02 | 個人工作流程 | 講者示範自己怎麼用簡短訊息交代任務,OpenClaw 能記住先前對話的脈絡,不必每次重新解釋來龍去脈。 |
| 01:41 | 多 agent 平行處理 | 搭配 git worktree 同時開多個 agent,方便做 CI 與整合測試。 |
| 02:12 | 除錯與自主性 | 遇到 timeout 之類的問題仍要手動調整,但講者也提到自己正往「讓 agent 更自主」的方向推進。 |
| 03:21 | 兩個核心概念 | 講者提出「溝通要無摩擦」與「依任務決定放手程度」:有時放手讓 Agent Orchestrator 管理 worker,有時改用 cmux 終端機自己盯著。 |
| 04:33 | 分層授權架構 | 再往下一層是「managed agents」:worker 執行 Claude Code,Claude Code 自己又能開 agent 與 subagent,這層是講者目前調整最頻繁的地方。 |
| 05:21 | 為何不直接用 Claude | 回答聽眾提問:用 OpenClaw 是為了讓決策圍繞在 spec 與任務脈絡,避免程式碼細節占掉太多 context。 |
| 06:15 | 測試該不該用瀏覽器 | 能靠 MCP/HTTP 驗證的邏輯就不必動用瀏覽器,只有真的需要視覺確認的部分才跑瀏覽器測試。 |
| 06:46 | 瀏覽器測試進步很快 | 講者觀察到 agent 處理彈出視窗、輸入密碼這類瀏覽器操作的能力,這半年到一年進步明顯。 |
| 07:40 | side project:AI RPG | 展示一個會依玩家選擇生成專屬世界、還有骰子判定機制的 AI RPG 網站,避免像一般聊天那樣「太容易贏」。 |
| 08:45 | side project:多模型比對 | 另一個網站會把同個問題丟給多個模型,再把答案整合進單一模型比較,講者拿它來查 PR 狀態之類的日常問題。 |
| 09:54 | 管理者視角減少偏誤 | 講者說用終端機扮演「管理者」而非「寫碼者」,反而能看出某個 PR 其實該被別的 PR 取代,而不是一味覺得進度都在往前走。 |
| 11:04 | cmux 共同創辦人上台 | cmux 創辦人之一介紹新功能:Claude Code Teams 整合會自動開終端機顯示 subagent 動作,也支援 SSH 連到其他電腦執行 OpenClaw。 |
| 12:47 | 現場排除安裝問題 | 講者協助一位聽眾排查 OpenClaw 安裝與 sandbox 設定的問題。 |
| 13:37 | Sandbox 該怎麼用 | 講者釐清「Docker 隔離」跟自己的 staging 環境是兩回事,並說明外接 bot 或測試新模型時才值得多花 token 換可靠度。 |
| 14:41 | 模型選擇與成本 | 講者主要用 Codex 5.3 當預設 orchestrator,token 用量吃緊時會切換到 MiniMax,主要是為了省錢而不是效果更好。 |
值得記的話
名詞與人物
| OpenClaw | 講者用來統籌任務、串接多個開發 agent 的工具,決策依據是任務脈絡與歷史,而不是程式碼本身。 |
|---|---|
| cmux | 一款終端機管理工具,適合平行跑多個 AI 開發流程,並支援 SSH 連線與 Claude Code Teams 整合。 |
| Agent Orchestrator | 講者 fork 的開源框架,用來管理底層負責實際寫碼的 worker agent。 |
| Claude Code | worker 實際執行寫碼工作所用的工具,本身也能再開出 agent 與 subagent。 |
| Codex | 講者目前主要拿來當預設 orchestrator 模型的程式模型,版本用到 5.3。 |
| MiniMax | 講者在 token 花費吃緊時會切換過去的模型,效果不如主力模型,但能省錢完成工作。 |
延伸
- 講者提到自己在做一個叫 skeptic agent 的客製化 code review 工具,但沒有進一步說明細節。
- cmux 支援透過 SSH/Tailscale 連到其他電腦,甚至可以在 Mac mini 上遠端跑 OpenClaw,這場只點到為止。
- cmux 新推出的 Claude Code Teams 整合會自動開終端機顯示 subagent 動作,實際畫面這場沒有展示。