難度一。主力做完,另一家只審成品。
這篇在講什麼
找第二個 AI 來挑錯,這件事有三種深度:只審最後結果、兩邊各跑一次再併回、完整雙軌互審。多數人只知道第一種,而第一種剛好抓不到最貴的那種錯:一開始就走錯路。
這篇給的是選擇的方法與可以直接複製的指令。三種難度分別怎麼跑、什麼情況選哪一種、成本差多少、跑幾輪要停、對家聯絡不上怎麼辦、只能用一家模型時還剩什麼。
- 已經會叫另一個 AI 幫忙看,但不知道什麼時候該看得更深的人
- 重要文件送出去之前會緊張,但又不想每件事都跑滿全套的人
- 想把「找第二顆腦」變成固定流程,而不是想到才做的人
- 三種難度各自的做法與可直接複製的指令
- 一組判斷:這件事該用哪一種深度
- 停止條件、斷線備援、只能用一家模型時的替代做法
一、先用一句話講完為什麼
愛吃辣的廚師,需要的是一個不吃辣的試吃員。他沒有要騙人,他就是喜歡吃辣。
所以叫同一個模型自我審查三遍五遍,意義不大,而且更花錢。換另一家來看,常常一下就抓到問題。這一段是前提,接下來講的是:要換得多深。
二、三種難度
難度一:只審最後結果
主力模型一路做到最後,另一家只看成品。這是我最早的做法,日常工作大多用這種就夠。
它抓得到什麼:寫錯、漏寫、前後打架。它抓不到什麼:主力模型在最一開始就選錯方向這件事。因為它只看到終點,看不到路。
難度二:兩邊各跑一次,再把好的併回來
兩家從同一份材料各自跑完,然後讓主力模型參考另一條線,把值得採用的併進來。
這一種的好處是成本比全套低,但你已經拿到「另一條路長什麼樣子」的資訊。適合中等重要、時間有限的事情。
難度三:完整雙軌互審
A 跑完審 B、B 跑完審 A,最後兩邊再互審一次。重大決策才這樣跑。
背景、限制、來源完全相同,一字不差。
不准偷看對方答案。先看了,第二軌就失去獨立性。
挑對方的曲解、矛盾與盲點。
收斂的可以合併,分歧的要列出來,不准自己選。
人決策,或讓沒有負責整合的那一家做終審。
三、怎麼選:三個判準
不用每件事都跑滿。我的判斷順序是這三個問題:
寄出去的提案、對外發布的文章、要拿去報價的數字,收不回來。收不回來的往上加一級。
格式明確的工作通常只有一條路,審結果就好。策略、企劃、跨領域整合往往有好幾條,那就值得跑雙軌。
如果連「這件事該從哪裡切入」你自己都不確定,那第一種難度不夠用,因為它只驗終點。
我自己的實務比例大概是:多數工作停在難度一,重要的東西跑難度三,難度二用在「想看看有沒有別條路,但今天沒那麼多時間」的時候。
四、成本:這套要花多少
固定成本:兩家各一份月費訂閱。桌面版工具就能互相呼叫,不需要另外接 API。這是我目前的用法,也是我覺得文書工作者做得起的門檻。
變動成本:同一件事,難度一大約是單跑一次的兩倍工作量;難度三會再明顯多一截,因為兩邊都要從頭讀完整份材料,還要各審一次。這是我抓的相對感覺,不是量測數字。
那三家會不會更保險?我算過就沒有做:
如果要每一家都審過每一家,工作量會往上翻好幾倍,時間也耗不起。以我的經驗,兩家已經能處理掉絕大多數問題,第三家換來的那一點邊際效益通常不值得。這裡的 90% 是現場口語估算與經驗判斷,不是統計數字。
五、跑幾輪要停
比「要不要互審」更容易被漏掉的是:修正幾次要停。不給上限,它會一直修到它覺得好為止,結果是費用一直往上,或越修越歪。
先定義一輪:
- 第一輪:A 審完 B,B 也審完 A
- 第二輪:A 依照 B 的建議再跑一次,B 依照 A 的建議再跑一次,然後互相再審一遍
兩到三輪還沒解決的,通常不是次數不夠,是規則本身缺了東西。這時候要停下來看規則,不是繼續跑。
兩個數字要分清楚,不然會覺得互相打架:「兩到三輪」講的是整條互審流程跑幾遍;「最多修兩次」講的是同一個問題自己重做幾次。前者是你在管的節奏,後者是寫進規則給它的上限。
怎麼知道是規則缺了東西
我在課堂上用收拾桌子解釋過:你給它一張整潔桌面的標準圖,加四個指標。它整理一輪、對照標準、沒達標就再整理。但如果桌上多了一顆球,而標準圖裡沒有球、也沒寫球該放哪裡,它再跑一百次也不可能完全符合。
這時候正確的動作是停下來回報:其他都擺好了,這顆球沒有規則,請你補。所以停止條件要寫兩層:
六、對家聯絡不上怎麼辦
這是實際跑久了一定會遇到的事。我有一台桌機兩台筆電,帳號會互相踢登出,互審常常斷線。
以前我的規則寫死「一定要互審」,結果一斷線整條流程就卡住,我回來看到的是做到一半的東西,等於零分。
現在的規則改成:對家沒回應,主軌先做完,然後告訴我另一家沒有審,並且產出一份交接指令讓我一鍵複製。那份交接要說清楚四件事:
第四點是重點。狀態要誠實,不然你下次看到它會以為這件事已經審過了。
七、只能用一家模型的時候
很多環境有這個限制:公司只採購一家、資安規定只允許特定服務、或是預算只有一份訂閱。
這時候跨家互審拿不到,但不是完全沒有替代做法:
- 開兩個乾淨的新對話,一個用「產出者」的角色設定跑,一個用「只挑毛病、不重寫」的角色設定跑
- 兩邊都不要看到對方的過程,只交換成果
- 再開第三個對話,只做比對,把兩邊不一致的地方列出來
八、把三種難度變成四句共同語言
最後一步是讓它變成你日常說得出口的東西。我把它收成四句:
難度二。兩邊各跑一次,把好的併回主線。
難度三。獨立跑完、交換審查、分歧交回人。
主軌先完成,標成待補審,留下交接指令。
關鍵字負責啟動,完整規則住在你的資料夾裡。這也是為什麼規則要寫在一個 AI 讀得到的地方,而不是每次重講一遍。
你可以怎麼開始
複製第二節第一段那則指令,貼給另一家。重點是「只做審查,不要重做」這句。
用同一份材料開兩條線,記得加「不要偷看對方的答案」。分歧列出來自己看,會比成果本身更有價值。
兩輪上限、規則沒寫到就回報。這一條比多跑幾輪有用得多。
相關的三篇
- 交代過的事 AI 為什麼老是忘記?:從『我記住了』到讓 AI 自己跑:互審的上一步,怎麼確認規則真的被記住、被啟動。
- AI 改了十幾次還是有錯,怎麼辦?:資料清理只是第一關,長文件審不出錯的三層設計:長文件要先處理材料與切法,互審才有意義。
- 人在外面,可以叫家裡的電腦先做嗎?:手機掃一次 QR code,桌機就開始跑:把這些規則放進一條真的在跑的迴圈裡長什麼樣子。