你把一份工作交給 AI,前半段順得不得了。它讀完資料、抓到重點、格式也對。然後不知道從哪一句開始,它變了一個人:你開頭講好的規則它忘了,你要它改第三段它順手把第一段也改了,你糾正它一次,它反而把前面對的地方也推翻。
這時候幾乎每個人腦中都會冒出同一個念頭:「是不是該再開一個 AI 來幫忙?一個負責找資料、一個負責寫,分工是不是就不會亂了?」
這個直覺,八成的情況下是錯的。多數人分身分得太早。你遇到的通常不是「一個人手不夠」,而是「這一個人沒有被管好」——他不知道邊界在哪、不知道什麼不能碰、做完也沒有人告訴他對不對。在這種狀態下再開第二個,你不會得到兩份產出,你會得到兩個失控的來源,外加一個新問題:出事的時候你分不出是誰的錯。
Agent = Model + Harness,表現不好先看環境不要先換腦袋,這是整個系列的底層原則。這一篇是同一句話的延伸:表現不好,先看環境,不要先加人。
[ AI 做到一半開始亂 ]
│
▼
Q1 它是做不到,還是沒被告知? ─沒被告知→ 補進常駐指引(不必分身)
│ 真的做不到
▼
Q2 這兩件事需要互相看不到嗎? ─不需要→ 留在同一個上下文
│ 需要
▼
Q3 失敗時要能分辨是誰的錯嗎? ─不需要→ 只跑一次的事,不值得
│ 需要
▼
[ 三題全過 → 分身,照「職責」切,不照「份量」切 ]
分身之前,先過三道題
第一題:它是做不到,還是沒被告知?這是最常被跳過的一題。AI 漏掉一個規則,九成不是能力問題,是那條規則根本沒寫在它看得到的地方——你在對話中段口頭補的一句,早就被後面的內容擠出視線之外了。這種情況該做的是把規則寫進專案的常駐指引,讓它每次都讀得到。多請一個人來提醒另一個人守規矩,這在人的世界也是荒謬的。
第二題:這兩件事需要互相看不到嗎?這是分身真正的判準。如果第二階段需要「乾淨的眼睛」,它最好不知道第一階段是怎麼想的,那你需要的就是兩個獨立的上下文,這是同一個對話視窗做不到的事。反過來,如果兩個階段本來就要共享全部脈絡,切開只會製造交接成本。
第三題:失敗時你要能分辨是誰的錯嗎?一個 Agent 出錯,你只能重跑整段;兩個 Agent 各自有明確產出,你可以只重跑壞掉的那一段。一件事你預期要反覆跑很多次,這個「可分辨」的價值會迅速超過管理成本;只跑一次的事,就不值得。
把常見狀況對照起來看,會更清楚哪些根本不該分身:
| 你看到的現象 | 真正的問題 | 該做的事 |
|---|---|---|
| 它忘記你講過的規則 | 規則沒進常駐指引 | 補進指引,不必分身 |
| 它一路認同自己上一句 | 立場上無法自我推翻 | 分身,交給乾淨的眼睛 |
| 它被前面查到的雜訊帶偏 | 上下文被污染 | 分身,隔離研究與產出 |
| 它就是做得慢 | 只是量大 | 加大 Harness,或平行同類工作 |
真要分身,用職責切,不要用工作量切
決定分身之後,第二個陷阱馬上就來:多數人是照「份量」切的,文章太長,切成三段給三個 AI 各寫一段。這是最沒有效益的切法。
| 依據 | 你會得到什麼 | |
|---|---|---|
| ✗ 照份量切 | 「太長了,切三段」 | 語氣不一致、論點互相重複,補接縫比自己寫還久 |
| ✓ 照職責切 | 「它該站在什麼立場」 | 各自產出可獨立驗收,出錯時知道要找誰 |
照職責切,站得住腳的只有三種:
| 分身理由 | 典型場景 | 真正的收益 |
|---|---|---|
| 立場衝突 | 寫完了要驗收 | 驗的人不知道寫的人怎麼想(誰當總指揮談誰產生、誰檢查) |
| 脈絡污染 | 先查資料再動筆 | 寫作階段拿到一份乾淨的輸入 |
| 獨立單元 | 十個檔案各自摘要 | 彼此不必看到對方,數量本身就是理由 |
立場衝突是三者中最容易被輕忽的。寫的人不該驗自己的東西,這在人類組織裡是幾百年的常識;在 AI 這裡只會更嚴重,因為它天生傾向認同自己上一句話。脈絡污染則最隱形:讀了十篇文章有八篇沒用,這些雜訊留在同一個上下文裡會持續影響判斷,而且你看不出來它在影響。分開的收益不是「分工」,是讓後段拿到乾淨輸入。
回到最前面那個場景。你的 AI 寫到一半開始亂,八成不需要第二個幫手,需要的是把你剛剛口頭講的那句規則,寫到它每次都會看見的地方。這件事做完,你會發現一個就夠了。
動手做
AI 做到一半開始亂、正想開第二個的,先過三道題。可以貼給正在亂的那個 AI,或自己回答:
先不要做事。我在考慮要不要再開一個 AI 幫手,請幫我回答三題: 1. 你剛才漏掉的那件事,是你做不到,還是我沒有寫在你每次都看得到的地方?如果是後者,請把那條規則寫成一句可以放進常駐指引的話。 2. 我想拆成的兩個階段,需要互相看不到嗎?(第二階段最好不知道第一階段怎麼想的,才叫需要) 3. 這件事我會反覆跑很多次嗎?如果只跑一次,分開的成本值得嗎? 三題答完,給我一句結論:不必分身/該分身,理由是三種之一(立場衝突、脈絡污染、獨立單元)。 剛才發生的事:(貼上)
三題全過、真要分身的,交辦要寫「立場」不寫「份量」。開兩個全新對話。第一個的第一句是「你負責產出,規格如下」;第二個的第一句是「你負責驗收,你沒有參與產出,清單如下」(可驗證目標那篇有驗收的提示詞)。兩邊都不要看到對方的對話,這就是「互相看不到」。用 Claude Code 的話,子代理(subagent)就是現成的「乾淨的眼睛」,叫它「用一個子代理來審查」就行。
分對了的樣子:你能說出這次分身是三種理由中的哪一種;兩個 AI 的交辦裡各有一句「你的立場是」,沒有「你負責前半段」;出錯時你能指出是哪一個的產出壞了;上個月你開過的 AI 數量比這個月多,代表你在補規則,不是在加人。
回想你上一次開第二個 AI 的原因,是三種理由之一嗎?多數人的答案是「因為它變慢了」或「因為它亂了」。那都是第一題,該補規則,不該加人。
表現不好,先看環境,不要先加人。三道題:做不到還是沒被告知?需要互相看不到嗎?失敗時要能分辨嗎?真要分,照職責切——立場衝突、脈絡污染、獨立單元——不照份量切。你剛口頭講的那句規則,寫到它每次都看得見的地方,多半一個就夠了。
站內延伸
- 規則該放在哪裡才會每次被看到 → 常駐檔是便條不是憲法
- 分身之後怎麼交接 → 交接單
- 誰產生、誰檢查 → 誰當總指揮
來源: 三道題與三種分身理由是我自己的整理。「寫的人不該驗自己的東西」在軟體工程裡是通則,Matt Pocock 的 code-review 用獨立子代理做審查(先紅燈再綠燈那篇有原始碼出處)是一個實例。
多數人分身太早,
該補規則不是加人
什麼時候看這張:它做到一半開始亂,你正想再開一個來幫忙。
- 它漏掉規則,九成是沒寫在它看得到的地方
- 第二階段需要乾淨的眼睛,才值得分開
- 只跑一次的事,分開的管理成本划不來
第一個動作回想上次你開第二個的理由,是立場衝突、脈絡污染、還是件數多?三十秒,答不出就先補規則。