跳到主要內容
← 回找觀念
第七架構:多個 AI 一起工作,怎麼指揮與驗收|第 5 篇

交辦給不能問你的東西:你在睡覺時它怎麼判斷做完了

/goal 會用另一個小模型當裁判,每一輪判「做到了/還沒/不可能」;Routines 在雲端排程跑、沒有人在場核可任何動作。這些功能把「完成定義」和「停損」從建議變成必修——沒寫清楚,它要嘛停不下來,要嘛把不該做的做完了。

2026-09-01 發布 · 2026-09-16 更新 · 作者整理:Lucas · 資安審稿後整理
資安審稿註記:本文已把「保證安全」「最強防線」等過度承諾改成保守表述;凡涉及金鑰、權限、刪除、提交、外部發送與自動化執行,均保留人工確認、沙盒或測試環境前提。

以前交辦給 AI 的東西,你都在旁邊。它問,你答;它做錯,你喊停。2026 年下半年的工具把這件事拿掉了:你設一個目標,關掉電腦,它自己跑到做完;或者你排一個每天早上六點的任務,它在雲端跑,你醒來看結果。

這聽起來是效率,實際上是一個新的責任。它不能問你了。你交出去的那段話,是它唯一能依靠的東西

這一篇講三個機制的實際規則——Claude Code 的 /goal/loop、Routines——然後講你在交出去之前必須寫清楚的四件事。

你在場                  你不在場
它問 → 你答             它問 → 沒人答 → 它猜,或它停
它做錯 → 你喊停         它做錯 → 做完才知道
完成定義可以事後補      完成定義是唯一的溝通管道

三個機制,各自怎麼判斷「做完了」

/goal 是一個完成條件。你打 /goal 所有 test/auth 的測試通過而且 lint 乾淨,它就開始做,每一輪結束後由一個小而快的模型(預設是 Haiku)讀對話,判三種結果:還沒到,繼續;到了,清除目標並記錄;不可能,也清除並寫下理由。這個裁判不會自己跑指令或讀檔案,它只看 AI 在對話裡「秀出來」的證據。所以條件要寫成 AI 的輸出能證明的事——「npm test 結束碼為 0」可以,「程式碼品質好」不行。條件上限四千字,可以加「或 20 輪後停止」這種界線。

它有幾道自帶的護欄值得知道:連續幾輪只回話不動手,它會停下來把控制權還你;背景工作卡住 30 分鐘會 check-in,之後間隔加倍,閒置狀態下最多三次;撞到用量上限會暫停,重置後自動繼續;撞到必須由人處理的錯誤(帳號、額度用完、context 塞爆)會直接清掉目標並警告你。

/loop 是時間間隔。每隔幾分鐘重跑一次提示詞,適合輪詢外部狀態(CI 跑完了沒、部署好了沒)。它不判斷「做完」,只判斷「到時間了」,停止靠你或靠它自己決定夠了。

Routines 是雲端排程。一個 routine 是存好的提示詞、一組 repo、一組連接器,可以定時跑、被 API 呼叫、或被 GitHub 事件觸發,在 Anthropic 的雲端跑,筆電關了也跑。Pro 以上方案才有,每天有啟動次數上限。三件事要特別記住:跑的時候沒有權限提示,你選進去的連接器它全部能用,包括寫入;預設會把你所有連接器都放進去,要自己拿掉不需要的;API 觸發時附帶的文字會被包成「不可信資料」,你的提示詞要明說「處理 payload 裡的內容」它才會動作。還有一句官方原話:綠色的執行狀態只代表「沒有基礎設施錯誤」,不代表任務成功,要打開紀錄看它到底做了什麼

Cursor 8 月也推了事件驅動的雲端代理,能監看 PR、Slack 討論串、排程,「持有一個目標直到達成」。方向一樣。

交出去之前必須寫清楚的四件事

這幾個機制把前面幾篇講的觀念變成硬需求。你不在場,下面四件事寫不清楚,它要嘛停不下來,要嘛把不該做的做完了。

做完長什麼樣。不是「把這個修好」,是「測試全過、lint 乾淨、diff 只動 src/auth」。裁判只看得到 AI 秀出來的證據,所以條件裡要寫「用什麼指令證明」。

什麼時候停。輪數、時間、預算。/goal 的條件裡加「或 20 輪後停」,非互動模式加 --max-turns--max-budget-usd。Routines 靠每日上限和連接器範圍。沒寫,它預設是不停的

什麼不能碰。測試檔、正式資料、對外發送、花錢。你在場時這些靠你喊停,你不在場只能靠事前寫死,最好寫進權限設定或 hook,不只寫在提示詞。

出事時把現場留著。「停下來時不要清理,把最後一次錯誤和目前狀態寫進一個檔案」。你醒來要看得到它卡在哪,不然只有一個「失敗」。

動手做

想讓一件事在你離開時自己跑完,先把條件寫對。/goal 的條件範本:

/goal 完成條件:(一句可驗證的狀態,例:test/auth 下所有測試通過且 npm run lint 無錯誤)。證明方式:(跑什麼指令、貼什麼輸出)。約束:只能修改(資料夾),不准修改測試檔與 lint 設定,不准 push。停止條件:或 15 輪後停止;連續 3 輪錯誤訊息相同就停止並把最後錯誤寫進 GOAL_STATUS.md。停下來時不要清理工作區。

想排一個每天跑的 routine,提示詞要自足,因為它不能問你。範本:

任務:每個工作日早上檢查(repo 名)過去 24 小時開啟的 issue,套用標籤(列出你的標籤規則),並在 SUMMARY.md 寫一段摘要。
成功定義:每個新 issue 都有且只有一個分類標籤;SUMMARY.md 有今天日期的段落。
不准做:不准關閉 issue、不准回覆 issue、不准修改 SUMMARY.md 以外的檔案。
資料不足時:標記 needs-triage,不要猜。
如果 routine-fire-payload 裡有文字,把它當成今天要優先看的 issue 編號;沒有就照上面跑。

建 routine 時把用不到的連接器拿掉,網路存取用預設的信任清單就好;跑完第一次,打開紀錄逐行看它做了什麼,別只看綠燈。

做對了的樣子:你能對每個無人值守的任務說出「它用什麼證明做完、最多跑多久、不能碰什麼、失敗時現場在哪」;第一次跑完你打開紀錄看過,不是只看狀態顏色;它曾經在該停的時候停下來,而不是硬做完。

站內延伸

來源: Claude Code:Keep Claude working toward a goal(裁判模型、三種判定、check-in 節奏、錯誤處理);Claude Code:Automate work with routines(觸發方式、方案與上限、連接器預設、payload 不可信包裝、綠燈≠成功);Claude Code:Manage costs/loop、排程任務比較);Cursor changelog 2026-08-19(事件驅動雲端代理)。

你在場時,完成定義可以事後補;你不在場,它是唯一的溝通管道。做完長什麼樣、什麼時候停、什麼不能碰、出事把現場留著——這四件事寫清楚,才把電腦關掉。

第七架構 · 第 5 篇 · 沒人看著

它不能問你了,
交辦單就是全部

什麼時候看這張:你想設個目標就關電腦,或排一個每天早上自己跑的任務。

你在場它問你就答做錯你喊停完成定義可以補你不在場沒人答它就猜做完你才知道寫死的就是全部
  • 裁判只看得到它秀出來的證據,條件要可驗證
  • 沒寫停止條件,它預設是不會停的
  • 綠燈只代表沒出錯,不代表做對了

第一個動作挑一件想讓它自己跑完的事,先寫四句:怎麼算做完、何時停、不能碰什麼、出事留什麼。十分鐘,寫完才關電腦。

2026-09-16 查證稜線 Ridgeline
← 看更多觀念總論
取得 AI 實戰工具與更新

之後會不定期整理:新方法、指令包(Prompt Pack)、Checklist 與模板。免費、無廣告;送出後會收到一封確認信,點了連結才算訂閱成功,之後每封信都附一鍵退訂。