我對 AI 說「跑 loop」,有四種講法:只說 loop、把這件事跑 loop、Loop 護欄、全自動 loop。它們在不同時間、為了不同問題長出來,各自都有規則條文,但從來沒有一句話說它們是什麼關係。今天我把它們整併成同一套機制的四種入口,這篇寫的是整併之後的樣子:四個入口只差三件事,而決定「要被檢查多嚴格」的那一格,四種說法完全一樣。
- 試過叫 AI 自己跑,結果它跑到一半停下來問你一個你看不懂的問題,你就放棄了。
- 已經在用 AI 做事,也寫過自訂指令,但每次都要盯著,不確定什麼時候可以放手。
- 要把一套 AI 做事的方法交給團隊或客戶,需要一份講得清楚、出事有交代的結構。
- 一段可以直接複製貼上的指令,貼下去 AI 就會自己填完成證據、停止條件與換路條件,不必先有任何規則檔。
- 一張授權詞對照表:你說「可以建議」「你決定」「做吧」各自代表什麼權限,可以直接貼進團隊的教育訓練。
- 一個判斷方式:把「AI 要不要問我」跟「這件事要被檢查多嚴格」拆開,前者你可以調,後者交給任務本身決定。
一頁比較表,逼我承認一件事
我對 AI 說「跑 loop」,有四種講法:只說 loop、把這件事跑 loop、Loop 護欄、全自動 loop。這四句我都在用,用了好幾個月,但今天早上一頁比較表逼我承認:我從來沒寫下它們是什麼關係,各自散在規則庫不同地方。
先講清楚,這句話今天才成立,不是我發現了一個一直存在的事實。四個講法過去各自運作、各自有條文,我沒辦法宣稱它們過去就是同一套。今天做的事是整併:把它們收進同一組底層條文,只留幾個明確的差別。
這篇文章寫的是整併之後的樣子:它們差在哪、怎麼選、以及三個實跑案例。
四種說法整併之後:一組不動的核心,三個開關
整併的第一句話是這樣寫的:
這不是四套 Loop,是同一套 Loop 的四種入口與執行強度。
底層共用一整組條文,包括任務分級、驗收契約、停止條件、換路煞車、授權紅線、收尾欄位。四個入口只改三件事:
| 說法 | 開跑前問不問 | 要不要加抗辯層 | 卡住時 | 判級與審查強度 |
|---|---|---|---|---|
| 只說 loop | 前文能辨識任務就不問,三種例外先確認一次 | 依級數自動決定 | 依停止條件與換路煞車 | 由任務決定 |
| 把這件事跑 loop | 通常不問 | 依級數自動決定 | 同上 | 由任務決定 |
| Loop 護欄 | 缺授權才問 | 明確加上 | 同上,另加「無法收斂的分歧交我拍板」 | 由任務決定 |
| 全自動 loop | 開跑前一次問完,開跑後零提問 | 依級數自動決定,不因全自動減少 | 換工具、換方法,或記錄跳過續跑 | 由任務決定 |
看最後那一欄。四列寫的都一樣:我用哪一句話啟動它,不會改變它要接受多嚴格的檢查。檢查強度只跟這件事本身有多大風險有關。
怎麼選
一般任務直接說「把這件事跑 loop」。想找碴、要它先被挑戰過再給結論,說「Loop 護欄」。不想中途被問、要它一口氣做完,說「全自動 loop」。三句話對應三種節奏,底層的判級、驗收、停止條件完全一樣。換句話說,你選錯了也不會出事,頂多是問得比較多次或比較少次。
(規則檔還加了一句禁令:不准把任一入口另立規則或另建檔案,防的是四份數字以後互相打架。)
開關一:開跑前問不問
自主度有三級,我一句話切換。
預設不喊,就是 Loop 模式,按任務級數自動判。說「自動一點」,就是更主動、更少回頭問。說「全自動」或「自己跑」,是最高的一級。
最高那一級的行為細則寫得很硬:
立刻開始,不用問題開場。要釐清的在開跑前一次問完,開跑後不再因為決策停。一個階段做完直接接下一個階段,跑到完成為止,完成以客觀條件為準,不是做完一個階段就收工。所有被跳過的項目和待我決策的清單,最後一次彙整回報。
規則檔還直接列了三個反例:沒開始就停問、為小問題停、做完一階段就收工。
這一級唯一多帶的東西:我說「全自動」等於當次授權螢幕與網頁操作(嚴格算是第四項差異,不屬於三個開關,但只有這一項例外)。搭配一個硬上限,同一個問題卡超過五次或超過三分鐘沒頭緒,就跳過、寫日誌、繼續跑,不在原地耗。
這個開關調的只有「問不問」,不會讓 AI 可以動它本來不能動的東西。那是另一條紅線,跟自主度無關,見下面「延伸」區。
開關二:要不要加抗辯層
「Loop 護欄」多做的五件事:未抗辯假設盤點、三視角抗辯、證據等級區分、換路煞車、無法收斂的分歧交我拍板。
三視角是三組問題,不是三個代理:
- 邏輯:這個結論是不是只靠單一證據?有沒有把相關當成因果?有沒有忽略相反的證據?驗收條件真的能證明結論嗎?
- 失效與安全:最壞情況是什麼?會不會碰到金鑰、權限、資料遺失、公開發布、金錢或不可逆的操作?失敗的時候怎麼還原?有沒有看似可行但會放大風險的捷徑?
- 過度工程:有沒有更小的第一步?是不是把一次性任務做成了永久系統?能不能先用現有的看板、腳本或手動驗收完成?
「未抗辯假設」是一個標籤,用途是把還沒被挑戰過的重大結論標出來,不准寫成已確認的事實。可用的寫法是「未抗辯假設:目前看起來根因是⋯」「單腦初判:尚未跨家審查」「僅自攻:同家模型自我挑戰過,但不等於跨家審稿」。
這個開關有一個容易誤解的地方:比較大的任務就算我只說 loop,也會自動套用護欄。喊出「Loop 護欄」的作用,是在小任務上、或者我想額外加重的時候,把它明確叫起來。兩者不互相取消,也不會重複跑兩遍。
- AI 一直停下來要授權,怎麼讓它順順跑完?:迴圈護欄的五條規則 那篇是這五件事的完整版,一條一條講怎麼用、遇到什麼狀況該套哪一條。這篇只講它在四個入口裡的位置。
開關三:卡住的時候停不停
同一個方法連續失敗兩次就換路,不做第三次同路盲試。出現「應該可以」「看起來沒問題」但拿不出證據的,一律視為未驗證。
卡住先分辨卡在哪一層:環境層(工具、權限、資料夠不夠。缺工具重想十次也不會成功)、驗證層(是不是假成功)、流程層(該不該換路)。多數卡住是第一層,不是模型不夠聰明。
四個入口在這裡的差別:前三種卡住就停下處理,全自動那一種會把卡住的項目記下來、跳過、繼續跑其他階段,最後一次彙整。
這也是為什麼我的規則庫裡,防止跑太多的條文跟鼓勵多跑的條文一樣多:反思兩到三輪報酬遞減就停、任務狀態分成「完成/部分完成/卡住/失敗」四種、預設一輪主跑不無限補救,這幾條合起來,就是我不讓它自己一直跑下去的方法。
你現在就可以用的最小版本
下面這段可以直接貼進對話,貼下去就能用。你不必記上面那四種說法,也不必先有一套規則檔,這段本身就是完整的。它涵蓋了核心裡最關鍵的四件事:完成證據、審查強度、停止條件、換路條件。
接下來這件事用 loop 跑。 開跑前先做兩件事,做完直接開始,不要拿來一項一項問我: 先用一句話重述你理解的任務範圍,並說明你手上有哪些工具跟權限可以用。 然後在心裡填完下面四格。 1. 預期改變:這輪結束後,哪一個我看得到的狀態應該不同 2. 最小完成證據:你要拿出哪一項證據,我才能確認那個改變真的發生 3. 停止條件:反思最多兩到三輪,沒有新證據就停,用「完成/部分完成/卡住/失敗」四選一收尾 4. 換路條件:同一個方法連續失敗兩次就換方法或回報,不做第三次同樣的嘗試 四格裡任何一格填不出來,或任務範圍你不確定:把任務縮小到你填得出來的範圍, 寫下你採用的假設,然後開始跑。不要自己擴大範圍,也不要停在那裡等我補說明。 三件事你必須停下來問我,其餘自己判斷直接做: - 不可逆的動作(刪除、覆寫、送出、發布、付款) - 需要我的帳號、密碼或個人資料 - 商業或策略決策出現兩個以上實質不同的選項 收尾固定回報這四行: 做到什麼|驗收方式(命令輸出/逐項比對/第二個模型的意見/只是目測)|沒做完的風險|下一步 如果你沒有工具可以實際執行、也沒有第二個模型可以問: 就只做計畫、自我檢查,並且把不能驗證的項目一條一條列出來。 不要把「我認為應該可以」或「看起來沒問題」寫成完成。
要加審查層的時候,在上面那段後面追加:
另外加一層:在你給我結論之前,先用三個角度自己挑戰一遍,並把挑戰結果寫給我看。 - 邏輯:這個結論是不是只靠單一證據?有沒有把相關當成因果?有沒有忽略相反的證據? - 失效:最壞情況是什麼?會不會碰到不可逆、金錢、隱私或公開發布?出事怎麼還原? - 過度工程:有沒有更小的第一步?是不是把一次性的事做成了永久系統? 沒被挑戰過的重大結論,一律標成「未抗辯假設」,不要寫成已確認的事實。 你自己挑戰自己只能算「僅自攻」,跟換一家模型來審是兩件事,不要混寫。
要放到最高自主度的時候,追加:
這件事全自動跑,開跑前要問的一次問完,開跑後不要再回頭問我。 - 一個階段做完直接接下一個階段,跑到完成條件全部有證據為止 - 普通的卡點自己換方法解決,同一個問題卡超過三分鐘或五次就跳過、記錄、繼續跑其他部分 - 碰到上面那三件要問我的事:停在那個動作之前,跳過、記下來、繼續跑別的,最後一次列給我 跳過不算違反全自動,動手才算違反授權。
我自己用了幾個月之後最有感的一句,是護欄檔案裡的那句:預期改變跟最小完成證據如果寫不出來,先縮小任務,不要靠增加回合、模型或檢查清單來補模糊的需求。
Loop 不會讓模糊的問題變清楚。它只會讓模糊的問題跑很多圈。
- 每件事 AI 都要我確認,怎麼可以更自動?|什麼是迴圈工程 一個迴圈的五個階段與最少零件,全程沒有程式碼。
- AI 一直停下來要授權,怎麼讓它順順跑完?:迴圈護欄的五條規則 開關二那一層的完整版。
- AI 自己跑,會不會一直跑到額度燒完?|迴圈的圈數上限,三行寫進規則檔 可直接貼進規則檔的三行停止條件。
- AI 每一步都要我按確認,我可以放手到哪裡?|從駕馭工程到迴圈工程的那一步 這篇的前一站:那些重複到你已經不看的確認,就是你還沒寫出來的規則。
- 同樣的事,每次都要重新跟 AI 交代一遍?|我把發文、提煉、復盤三件事設計成 Loop 三條我自己在跑的 loop,加一個今天就能做的第一步。
延伸:如果你想知道完整脈絡
到這裡,四個入口怎麼選、卡住怎麼辦、能直接用的指令都給完了。下面是背景與細節:整併之前每個入口的來歷、判級與證據制度怎麼運作、規則住在哪四層、三個真的跑過的案例,以及目前還沒補上的機械保底。想直接拿去用的人可以在這裡停下。
四種說法從哪來
先講它們各自為什麼存在,因為這決定了後面該怎麼整併。
只說 loop,是最常見的用法。前文剛講完一件事,我丟一句「loop」,意思是「把剛剛那件事跑完,該驗的驗,該停的停」。這種用法的風險是指涉不清,所以規則裡留了三種要先確認一次的情況:不知道我要 loop 哪一件事、可能是在要求執行也可能是在檢查機制本身、不同解讀會導致明顯不同的結果。三種都不命中就直接跑,不逐項問。
「把這件事跑 loop」,跟上面唯一的差別是任務指向已經被我鎖定了,那三種確認情形不再適用。
「Loop 護欄」,是 2026 年 7 月 6 日從一次外部專案審查收斂出來的。當時的結論寫得很明確:不安裝原專案、不 fork、不改全域設定,只萃取可以跨代理使用的護欄。它多做的是抗辯,不是多跑幾輪。
「全自動」,是最早立的,2026 年 6 月 27 日。立因是我自己的痛點:AI 做完一個階段就收工,或者為了一個小問題停下來問我,一整條流程要我推十幾次才跑得完。
四個東西在四個時間、為了四個不同的問題長出來。各自都對,合在一起就模糊了。
- 每件事 AI 都要我確認,怎麼可以更自動?|什麼是迴圈工程 那篇用寫一篇文章當例子,講一個迴圈的五個階段跟最少要哪幾個零件,全程沒有程式碼。先看那篇再回來,這篇會好懂很多。
不變的核心之一:審查強度由任務決定
這是最常被搞混的一格。判級決定要被多嚴格地挑戰,跟我當下多想放手,完全是兩件事。
| 級 | 什麼樣的事 | 做法 |
|---|---|---|
| L0 機械 | 查時間、改一句、開一張卡、單一明確命令 | 直接做,只自查 |
| L1 小型 | 單檔、低風險、可逆、目標清楚 | 簡短自查,不寫日誌 |
| L2 複雜 | 多步、多檔、多工具、需判斷、影響後續 | 可拉一次第二顆腦,收尾簡短復盤 |
| L3 高風險 | 改規則主檔、改技能包、改攔截器、部署、公開的程式庫、金鑰、社群發布、批次搬移、商業決策、對外承諾 | 先計劃加備份、跨家審查、明確驗收,才准回寫規則 |
判級規則很簡單:命中任何一個 L3 條件就是 L3,命中兩個以上 L2 條件就是 L2,其餘往低。
「跨家」的定義有一條硬門檻:審稿的模型要跟產出的模型不同家。Claude 寫的東西由 Claude 的子代理審,那不算跨家,只能標「僅自攻」。
這條的理由,是我這套規則庫採取的一個風險假設:同一家模型的盲點可能高度重疊,自己審自己不夠保險。我沒有做過模型間盲點重疊度的實測,這是設計時選擇的保守立場,不是已經被證實的通則。用不同家來審,成本只多一點,但可以避開這個假設萬一成立的後果。
收尾欄位有一格專門防這件事,寫法固定成「producer 是誰、reviewer 是誰、結果是已回收並讀取還是只準備了交接」。派工出去但沒真的收回來讀過,只能標「交接已準備」,不准寫成已跨家。
這一格今天就派上用場了。這篇文章的跨家審,我前兩次都拿到假的成功訊號,第三次才真的收回意見,細節在下面第三個案例後面。
不變的核心之二:開跑前只鎖兩件事
四個入口共用的核心,最小的寫法只有兩格:
預期改變:這輪結束後,哪一個可觀察的狀態應該不同。
最小完成證據:用哪一項最小的證據,能確認那個改變真的發生。
接著那句才是重點:
若兩項寫不出來,先縮小任務,不靠增加回合、模型或檢查清單補模糊需求。
模糊的需求丟進迴圈,只會得到跑很多圈的模糊結果。
證據本身也分等級,由強到弱四級:機器驗收(測試、腳本、命令輸出、檔案存在、計數)、資料複驗(逐段讀檔、來源對照、看板比對)、跨家審查意見、人工目視或推論。最後一級只能標低強度,不能單獨支撐高風險的完成。
禁用的證據列了四項:「看起來沒問題」、「應該可以」、「我已經檢查過」但不列檢查方式,以及子代理的回報本身。最後一項的理由是,子代理回報只是線索,主控要自己獨立複驗。
還有一條專門防假成功的:系統層的 completed、exit code 0、子代理回覆或檔案存在,只能證明流程結束,不能證明任務做到。
這條的立因是 2026 年 8 月 8 日的一次事故。背景指令傳了一個它不支援的參數,直接退出什麼都沒做,但 shell 仍然回 0、背景任務仍然標 completed,只有 log 大小露餡,178 bytes。差一點就把根本沒改到的錯圖當成改好了發出去。
不變的核心之三:說了全自動,也有一組動作它不做
全自動最高,但有一組窄紅線不隨自主度放寬:不可逆的操作、對外送出、金錢行為、把金鑰送到外部、破壞性的刪除或覆寫。
處理方式很關鍵。它停在那個實際動作之前,跳過、記錄、繼續跑其他階段,最後把待授權清單一次彙整,整條流程不會停下來等。規則檔用一句話把它講死:
跳過不算違反全自動,動手才算違反授權。
這條後面掛著一張「授權詞分級表」。它的立因是 2026 年 8 月 24 日,一天之內發生三次同型錯誤,AI 把我的傾向當成施工授權。第三次是另一個 session 主動標記「我把這個記成你的轉述,不是我收到的直接指令」才攔住的,不是出錯那一端自己把關攔住。
同一天出現三次,我當時的判斷是這已經不像偶發,比較像預設行為,所以直接立成規則。這是我看到三次之後做的處置決定,不是統計上的結論。
| 我說的話 | 意思 | 可以做什麼 |
|---|---|---|
| 「可以建議」「你覺得呢」「你怎麼看」 | 要提案 | 只能寫方案、給選項、列成本與風險。不碰任何實體檔 |
| 「我覺得 X 比較好,還是 Y?」 | 要判斷 | 回答並說明依據。沒得到後續確認前不動手 |
| 「好」「可以」「OK」單獨出現 | 看前文有幾個待辦 | 只有一個明確待辦才算授權那一件。有多個選項一律視為未授權 |
| 「你自己斟酌」「你決定」 | 授權判斷細節 | 可以動,範圍限在當次討論那件事,不擴散 |
| 「做吧」「開始」「改」「修」 | 授權施工 | 可以動,仍受任務分級與窄紅線約束 |
| 沉默、沒有反對 | 不是授權 | 等於還沒回答 |
另外還有一條硬規則:改任何「會被自動流程呼叫」的東西,一律要明確的施工授權,不吃軟性同意。判準是性質不是路徑,只要它會被排程、攔截器、其他腳本或別的 session 自動觸發就適用。
理由寫得很直接:自動流程的錯誤不會當場報錯,它會在下一次觸發的時候才爆,或者靜默失效沒人發現。
規則住在四個地方,各管一件事
先講為什麼不寫在同一個檔案:每次對話都要載入的東西,塞越多越沒人看;只在需要時才讀的東西,可以寫得很細。這兩件事沒辦法在同一份檔案裡同時做到,所以拆開。
四層實際上是這些東西:
| 層 | 實際上是哪些檔 | 多大 | 什麼時候被讀到 |
|---|---|---|---|
| 憲法層 | 知識庫根目錄的 AGENTS.md,一份 | 約 36,000 字,但涵蓋全部主題 | 每次對話開場自動載入,所有 AI 代理都吃 |
| 細則層 | 技能包底下的 references/*.md,幾百份 | 單一主題約 5,000 到 15,000 字 | 憲法層的路由指到才讀 |
| 操作層 | 114 個技能包各自的 SKILL.md | 一份約 3,000 到 10,000 字 | 觸發詞命中才載入 |
| 狀態層 | 看板卡與交接檔 | 一張卡幾十字 | 換機、換模型、隔天接手時看 |
注意憲法層那 36,000 字。它不小,但那是全部主題加起來的量。單看任何一個主題,在那一層通常只佔一兩行,剩下的都在下面三層。
同一條規則,在四個地方各長什麼樣
拿這篇前面講過的「換路煞車」當例子,它在四層的實際長相:
| 層 | 換路煞車在這一層長什麼樣 |
|---|---|
| 憲法層 | 完全沒有規則內容。它只在一行路由裡被順帶提到:「Loop 護欄為正式觸發詞 → 先讀〔某個檔案〕;用於重大結論、交接、未抗辯假設、三視角抗辯、換路煞車、驗收證據分級」 |
| 細則層 | 完整條文加數字:「非機械任務遇到同一路徑連續失敗 2 次,即換路、升級或回報,不做第 3 次同路盲試」 |
| 操作層 | 把數字翻成這個情境的動作。圖卡技能包寫的是:「同一張連續兩輪還是不合格就停下來回報,不硬幹」 |
| 狀態層 | 這一次任務的實況:停在哪、已經驗過什麼、還沒驗什麼、要怎樣才能續跑 |
四層講的是同一件事,但沒有一層在重複另一層。憲法層只負責讓 AI 想起來「有這條」,細則層才有數字,操作層把數字翻成這個情境做得出來的動作,狀態層記的是這一次跑到哪裡。
一條新規則該放哪一層
| 這條規則的性質 | 放哪 |
|---|---|
| 每次對話都要它在場,漏了代價很高 | 憲法層,而且只能寫一行,寫長了會稀釋掉旁邊的紅線 |
| 要寫數字、寫為什麼、寫例外 | 細則層 |
| 只有做某一類事才用得到 | 操作層,綁在那個觸發詞底下 |
| 只跟這一次任務有關,任務結束就沒用了 | 狀態層,不要寫進規則檔 |
判錯的代價是實的:放太高,每次對話都在讀用不到的細節;放太低,需要的時候不會被載入,等於沒寫。
還有一條規則叫「真相分身禁令」:同一個事實禁止在多個地方各寫一份、各自人工維護。要嘛那份副本改成自動生成,要嘛就只留一句「詳見某某檔」把人指過去。所以你會看到細則檔裡大量出現「引用,不重抄」「數字以那條為準」這種句子。
開頭提到的那份整合計畫,現狀快照表十列裡有八列寫著「引用,不新增數字」,就是這條在起作用。
跨 session 的續跑點,規則規定只能留在該任務原本所在的看板卡或交接檔,二選一,五個欄位:狀態、停在哪、已驗證、未驗證、續跑條件。而且明講:沒有跨 session 需求就留在當前任務裡,不另建檔案、不另建狀態檔。
三次真的跑過的紀錄
它們證明的是核心那幾條真的在運作:換路煞車會被觸發、證據分級會被執行、停止條件會讓人停手、判級會決定審查強度。
它們不能證明四個入口彼此等價。我的知識庫裡沒有「同一件事分別用四種入口各跑一次」的對照紀錄,那種實驗我沒做過,所以不寫。
一、跨家審跑兩輪就停,因為文章自己寫的上限就是兩輪
2026 年 9 月 1 日,我把一篇脆文寫成官網深度文章上線。那篇的主題剛好就是「迴圈要跑幾圈」。
跨家審跑了兩輪。第一輪退三點,全部採納:「跑不出來多半是人講不清楚」過度歸因,補了四種卡住原因的對照表;文中寫「最多三輪」但舉例實際跑了四輪,自己打架,改成「第三輪等於強制檢查點,加一輪由人批准」;缺「一輪怎麼算」的定義,補上。
第二輪判定第二、三點已修,第一點仍要改,要把「通常代表」降成「可能代表」。處理方式是把那個核心句改寫成第一人稱經驗陳述,保留判斷的力道又不宣稱普遍性,然後由人收斂定稿。
沒有加第三輪。因為文章自己寫的上限就是兩輪,加第三輪等於自己打自己臉。
同一天還有兩件事值得記。
部署腳本的第一關索引覆蓋率把我擋下來了,新文章沒補搜尋別名。這是機械閘門真的攔到東西,不是裝飾。回去補完別名重跑,第二次全綠。
最後那一關的版本驗收又回報「沒回傳」,這是連續第五次。照慣例不採信,自己抓線上頁面驗:本次版本的特徵字串六項全中、舊版句型三項零殘留、封面圖、社群縮圖、別名庫、資料檔、索引全部正常。日記裡把它列進「待追的事」:這個關卡本身應該已經失效,值得單獨查。
這一段對應的是換路煞車跟證據分級。腳本說「沒回傳」不是成功也不是失敗,屬於狀態無法確認,所以換路,用最強那一級的證據自己驗,同時把失效的關卡記下來待查,不假裝它還有效。
二、第一輪不合格,我退稿,它自己認賬重跑
2026 年 9 月 10 日,也就是今天,另一篇官網文章。我問了一句:
你自己有用 AUT 讀一次嗎?
(AUT 是 AI 使用者測試,讓 AI 先扮演幾種讀者把稿子讀一遍。那套方法本身另外有一篇:做完的東西想找人幫忙看,卻找不到人?|AI 使用者測試,先跑過一次再找真人。)
它認了,而且把兩個瑕疵寫進證據檔。
第一,走查的標的錯了。跑的是文字稿內文,而速讀區那兩張卡是排版時才補的,補完沒有再走查一次。我退稿退的正是那兩張卡。
第二,違反了那個方法自己的硬規則第三條。技能包白紙黑字寫著「至少兩種受眾或狀態要帶摩擦,不能讓每個人都過度理性、過度有禮貌」,它三個模擬人設全部太客氣,沒有一個帶摩擦。
第二輪三個人設全部帶摩擦,三個人踩到同一顆地雷:「你可以帶走什麼」那三條寫成了文章目錄,不是讀者拿得走的成果。
複測只重跑了兩題,兩個阻塞點解除,判定影響輕微,停手。然後加了一句誠實邊界:
這是我寫的文章、我派的人設,屬 D 級證據(模型自己模擬自己)。通過只證明規格上有考慮到,不證明真人會照著走。
這一段對應三件事:停止條件(判定影響輕微就停手,不無限修)、證據分級(D 級就標 D 級)、獨立性要拿得出時間戳而不是自己說有。
還有一個處置我覺得比機制本身更重要。三個人設裡有一個的反應是「看完覺得照著三件事做就好,不用買」。這條不改。理由是我自己拍的板:
看文章就自己看得懂會做的,也不是我客人。
模擬受眾的意見不必照單全收。Loop 給的是輸入,拍板還是人。
三、同一輪工作裡,兩件事走了兩種審查強度
2026 年 8 月 31 日的一場例會整理。日記開頭的收尾欄位寫著:
分級:L2(動檢索頁資料層與部署,未動規則主檔與 Hook)
是否跨家:否,全程單腦初判,第二層策略結論已在母稿與網頁標註「未抗辯假設」
主線任務是 L2,沒有跨家,策略結論標成未抗辯假設。這是合規的,L2 本來就只要求「可拉一次第二顆腦」,不是必須跨家。
但同一輪裡有一件事被抽出來另外處理。跨家抽查抓到一個真缺口:卡片有兩條資料來源,前端是合併制而且其中一條優先,而檢查腳本只驗其中一條,擋不到另一條。查了現況,目前的資料剛好都在限制內所以還沒出事,但缺口成立。補救是在前端加統一截斷,並且在技能包裡誠實標註「往那條來源補登的時候要自己守字數,不要靠機械擋」。
日記在這一段的結尾寫:
這條規則本身是 L3(改技能包),已跨家審,審出的兩點都採納並修掉。
同一輪工作,主任務 L2 單腦,衍生出來的規則變更 L3 跨家。
判級是對「這件事」判,不是對「這一輪」判。
附帶一個當場發生的:我把一次成功的審查判成失敗
寫這篇的時候,我讓它跑跨家審,過程比預期難看。
第一次把文章全文塞進命令列參數,結果檔停在 24576 bytes,剛好卡在整數邊界,內容還停在我送進去的提示中間,沒有任何回覆標記。這次是真的失敗。
第二次改傳檔案路徑,我去看結果檔,0 bytes。我判定它又失敗了,於是換路,第三次改成前景執行,順利拿回結論。
但第二次其實成功了。我後來回頭看,那個檔案在 22:19:36 寫完,內容完整,判定跟五點意見都在。我讀它的時間比它寫完早了幾十秒,看到當下的 0 bytes 就宣布它失敗。
我犯的正是這篇文章在講的那個錯,只是方向相反。規則裡寫的是「系統說成功不等於做到」,我做的是「系統還沒說完,我就說它沒做到」。兩種都是拿當下的狀態當結論,都少了同一件事:等到一個真正能代表結束的訊號再判斷。那個訊號一直都在,是結尾那行 token 用量,我沒等它出現就下判斷了。
意外的收穫是,兩次獨立跑出來的審查結論高度一致,都判需要大修,五點裡有四點實質相同。這變成一次計畫外的交叉驗證。
而那五點裡最重的一點,是它指出我原本的骨架自相矛盾:我一邊說「四個入口只改三件事」,一邊又在表格裡多列了「判級」跟「審查強度」兩欄當差別,而下一節又寫「審查強度由任務決定,不由說法切換」。三句話沒辦法同時成立。
你現在看到的骨架是改過的版本,判級被移進不變的核心。而這一段,是我把自己的誤判也留在文章裡的紀錄。
目前還沒補上的機械保底
這一節是誠實聲明,因為一個沒有引擎的機制等於沒有機制。
最小驗收契約沒有機械保底。它掛在既有的收尾欄位上,三家模型都只受文字約束,沒有任何攔截器會擋。要不要補機械閘門是另一個待決的事。
急件通道的留痕靠自律。急件的規則是砍排隊跟審查、保留三道安全閘門,代價是上線後同一輪必須在日記裡逐條列出跳過了哪些審查。目前的檢查腳本只驗「有沒有寫日記」,不驗「跳過項有沒有列出來」。這一條已經登記在待補清單裡,補上之前不能宣稱有機械保證。
深度文章的檢查腳本只驗檔案在不在。它會攔「網頁有沒有產出」跟「證據檔有沒有產出」兩道,但驗不了走查跑得好不好、標題互審是不是真的獨立。第二個案例裡第一輪那個不合格的走查,就是機械檢查完全攔不到、只有人退稿才會被抓出來的類型。
模擬受眾的走查是 D 級證據。模型自己模擬自己,通過只證明規格上考慮到了,不證明真人會照著走。它的位置是真人測試前面的一道篩,不能取代真人。
失效的關卡還沒查。第一個案例那個版本驗收連續五次回報無法確認,目前的處理方式是不採信、自己驗,但那個關卡本身應該已經壞了,還躺在待追清單裡。
四個入口的等價性沒有實測。上面已經講過,我沒有做過「同一件事用四種入口各跑一次」的對照。整併是設計決定,不是實驗結論。
這篇只涵蓋一個人對 AI 說話的情境。如果是一個團隊共用同一個 AI,好幾個人同時下不同的指令,那是另一組問題(誰的指令算數、同時動同一份檔案怎麼辦),我另外有一套機制在管,不在這篇的範圍內。