每個 session 一啟動就注入。它強制 agent 在任何回應之前檢查有沒有技能適用——包括你只是想問個問題、想先探索程式碼,通通先檢查。它的紅旗表列出了 12 種常見的「合理化藉口」並一一反駁,例如「這只是簡單問題」→「問題也是任務。先檢查技能。」
這一步是整套系統「自己會動」的關鍵:不是你在觸發技能,是技能在確保你走到對的流程。
你只要說「我們來做 X」,agent 就自動進入 brainstorming。它不會馬上寫程式——它會反問你:你要解決什麼問題?有哪些需求?邊界在哪?然後把設計分區塊呈現給你確認。最後會存一份設計文件。
內建「視覺夥伴」(visual companion):可選的本機網頁工具,把討論的設計可視化,方便你邊看邊改。不想用就關掉,完全不影響流程。
設計定稿後,agent 在新的隔離 worktree上開始工作。這樣主分支永遠乾淨,多個功能可以並行開發互不干擾。它會先偵測你是否已在隔離環境(例如子模組或既有的 worktree),避免重複建立。
把設計拆成 2–5 分鐘就能完成的小任務。每個任務必須標清楚:確切的檔案路徑、完整的程式碼、驗證步驟。計畫寫得像「給一個熱情但沒品味、沒判斷力、又討厭測試的菜鳥工程師」照著做就能完成——這確保子代理照做不會跑偏。
拿到批准的計畫後,二選一:
可以自動跑一兩個小時不偏離計畫。子代理沒有你的對話上下文,這反而是優點——它只能照計畫行事。
執行過程每一步都被 TDD 把關:先寫失敗的測試 → 親眼看它紅 → 寫最少程式 → 親眼看它綠 → 重構。寫在測試之前的程式碼一律刪除重來,沒有任何例外。這保證交付的每一行都有測試證明它該存在。
任務之間與收尾前,agent 會requesting-code-review:把 diff 送去審查,按嚴重度(critical / warning / nice-to-have)回報。收到意見後用 receiving-code-review:先自己驗證、判斷技術正確性,不是照單全收也不是硬撐——有道理就改,沒道理就提出反證。
所有任務完成、測試全綠後,agent 驗證、然後呈現選項:合併、發 PR、保留、丟棄。你選哪個它就做哪個,並清理 worktree。