那一句話,和最後拿到的三樣東西
2026 年 9 月 28 日晚上,我在 Claude 的對話框貼了一支 YouTube 影片:唐鳳和丹增央措在 Platform 月台的公開對談,長 2 小時 17 分。我打的是:
照實說,它在跑的途中我又補了兩句:一句是「國泰直播我轉深度文章那樣」,把目標從報告拉到文章;另一句是「以後要有專題演講轉文章的模式,你順便寫技能包好嗎」。之後我就沒再下指令,等它交件。
最後拿到三樣東西:
| 產出 | 是什麼 | 放在哪 |
|---|---|---|
| 逐段觀點報告 | 43 段逐段重點,每段有時間碼、講者、原話,加上待查證清單 | 我的知識庫(自己回查用,不公開) |
| 官網深度文章 | 給讀者看的整理,十個重點、查證框、可複製的提示詞。當晚只做到本機預覽,隔天補上十張圖卡後才上線 | 每天用 AI,怎麼知道自己沒有被它牽著走? |
| 新技能包模式 | 「專題演講轉文章」,設計成下次一句話就觸發,還要等下一支影片實際驗證 | 我的技能包資料夾 |
一張會動的圖,看完那 39 分鐘裡誰在做什麼
四條線由上到下是:我、Claude(Anthropic 公司的 AI,這次主要在做事的那個)、Claude 另外開的小幫手(叫「子代理」,是另開的一個對話,專門假扮讀者試讀、在不知道我偏好的情況下比較標題)、Codex(另一家公司 OpenAI 的 AI,我平常簡稱它 CX)。
先試一件事:拖到 22:15 左右,看看 Claude 和 Codex 是不是同時在跑、我在做什麼。每一個色塊都可以點,點開會浮出那一步的細節和時間紀錄。
圖例:實心色塊=正在做;斜線=在等別人;空白=沒事;點色塊看細節。線條顏色:我Claude子代理Codex
你剛才應該看到兩件事。第一,22:12 到 22:18 之間,Claude 自己在讀那 4.5 萬字的字幕、寫逐段報告,同一時間 Codex 在另一邊獨立挑重點、上網查證,兩邊互相看不到對方寫了什麼。第二,我那條線幾乎都是空的。起手一句、途中補兩句,其他時間都沒有再下指令。
一句話為什麼夠:AI 第一個動作是去翻上一次怎麼做
「像之前國泰直播的影片那種」這幾個字,才是那句話真正的份量。
9 月 15 日,我請 AI 把國泰金控技術年會一整天的直播整理成九份逐場報告;9 月 24 日,又把它做成一篇官網深度文章。那兩次都留下了檔案:報告放在知識庫的固定資料夾,做文章的過程另外寫成一份「證據檔」,記下標題怎麼定、讀者走查說了什麼、審稿改了哪幾條。
這次 Claude 收到那句話,第一個動作就是去找這些檔案:國泰的報告長什麼樣、分幾節,國泰那篇文章的網頁怎麼組、證據檔記了哪些項目。找到之後照著做。我不用再解釋一次「詳細拆解」是什麼意思。
除了前例,它還會讀我知識庫裡的規則檔:做深度文章要走哪些關卡、標題要先寫三個讀者會搜尋的句子、要找另一家 AI 審稿、審不過不能交件。這些規則是之前一次次踩坑後寫下來的,這次它照著跑。
- Claude Skills 是什麼?把你的專業流程,變成 AI 能重複執行的知識資產:這一段只講「有前例就能一句話」,那篇講技能包本身是什麼、怎麼寫。
從貼網址到交件的八個步驟,一張表
有檔案時間戳的精確到分鐘;標「推估」的是依執行順序估的。
| 時間 | 步驟 | 誰做 | 產出 |
|---|---|---|---|
| 22:11(推估) | 找前例:翻出國泰那次的報告和證據檔 | Claude | 知道要做成什麼樣子 |
| 22:12 | 抓字幕:確認影片有頻道自己上傳的中文字幕,下載下來 | Claude | 3985 行、約 4.5 萬字的字幕 |
| 22:12–22:18 | 兩軌同時跑:Claude 讀全文寫報告,Codex 獨立挑重點、上網查證 | Claude+Codex | 逐段報告;Codex 的十個重點與十項查證 |
| 22:13 | 寫正文之前,先寫下三個讀者會搜尋的句子 | Claude | 工作標題 |
| 22:18–22:26 | 重排成讀者看得懂的文章,組成官網網頁,截桌機與手機畫面 | Claude | 文章網頁初版 |
| 22:27–22:31(讀者走查結束時間推估) | 讀者走查(子代理假扮三種讀者試讀)、標題盲審(只給候選標題,不說我偏好哪個);同時送 Codex 第一輪審稿 | 子代理+Codex | 一個硬退件、八個事實疑點、一份審稿意見 |
| 22:30–22:45 | 逐條修改;寫新技能包模式;送 Codex 第二輪、第三輪 | Claude+Codex | 文章與技能包都修到通過 |
| 22:47–22:50 | 第三輪通過,放上官網看板(我管理網站文章進度的清單)等我看,寫工作日記 | Claude | 交件 |
從 22:12 字幕下載,到 22:47 第三輪審稿回來,是 35 分鐘;從第一個動作(22:11,推估)到工作日記存檔(22:50),約 39 分鐘。
雙軌互審:我的 Claude 和 Codex 怎麼分工
這一部回答「AI 寫的東西,我怎麼確認它是對的」。
雙軌互審實際怎麼走:派工、各自跑、比對、整合、交叉審
先分清楚兩個詞。單軌互審是一家 AI 做、另一家看過再出結果;雙軌互審是兩家各自做一份,互相看不到對方的,做完再比對、整合,最後還要交叉審。那晚文章內容走的是雙軌,而且整個雙軌是 Claude 自己跑完的:我丟給它一個網址和一句話(途中另補兩句需求),派工給 Codex、比對、整合、送審都是它自己做,我沒有在兩家之間複製貼上。下面照實際順序拆開。按「播放」或「下一步」一步步看;上面綠色是 Claude,下面藍色是 Codex。
手機上圖比螢幕寬,可以左右滑動;每個圓圈和方框都可以點開看細節;播到第 10 步或按「完整圖」,整張流程會全部亮起來。
逐步文字版:五個階段與比對清單
同一份字幕,同時交給兩家。Claude 自己讀;給 Codex 的指令只附字幕檔,不給 Claude 寫到一半的東西,並寫明不要把工作轉交給 Claude。
- 43 段逐段重點,每段有時間碼、講者、原話
- 12 個核心重點
- 23 項待查證(只列出來,沒有查)
- 10 個重點,每點附時間碼與講者判斷依據
- 上網查證 10 項台上說法,附來源網址
- 8 處容易寫錯的名稱與數字
把兩邊的重點一條一條對起來。計算方式:同一件事,一家拆成兩點、另一家併成一點,算兩家都有。
- AI 讓下游也能改上游(反向對齊)
- 不能等市場自己解決,以及等待的成本由誰承擔(Codex 拆成兩點,Claude 併成一點)
- 台灣經驗:共識三週、制度三年
- AI 會向上管理,人只剩蓋章
- 新人還學得到:中間的紀錄看得懂
- 撞牆經驗寫成技能分享
- 「AI 生成」標籤不夠
- 先接住被遺漏的人
- 安燈繩(Claude 只寫在逐段內容,沒列成重點)
- 模型也要有版本號
- 馬和馬鞍交給不同家
- 不要跟馬賽跑(職場)
- 個人要有驗證和退出的權利
兩家都有的 9 點當主幹;Codex 多的 1 點、Claude 多的 4 點各自寫成一段;Codex 的查證寫成 7 個查證框,放在文章對應的段落;來源連結是第 1 輪審稿指出後才補上。
- 第 1 輪:大修
- 第 2 輪:小修
- 第 3 輪:通過
- 一個服務的價格與隱私說明兩點,自己打開官方網頁再核對一次
- 8 個來源網址逐一確認打得開
幾個設計上的重點:
- B 軌拿不到 A 軌的草稿。兩個 AI 如果先看到對方的答案,很容易順著對方寫,比對就沒有意義了。
- 比對時看重疊,也看各自多出來的。兩家都列到的 9 點,比較有把握是整場的主幹;各自多出來的 5 點,是單靠一家容易漏掉的東西。
- 查證交給不寫稿的那一家,寫稿的那一家再回頭核對。這就是「交叉」:Codex 審 Claude 的文章,Claude 也審 Codex 的查證。
- 審稿找另一家公司的 AI。寫稿的是 Anthropic 的 Claude,審稿的是 OpenAI 的 Codex,希望降低兩邊有同樣盲點的機會。
- 同一位審稿者審到底。第二輪、第三輪都把上一輪的意見一起附上,請它逐條確認改了沒。
這次是 Claude 在我的電腦上直接用命令列叫 Codex,派工、收結果、再送審都由它自己來。OpenAI 在 2026 年 3 月也推出了官方外掛 codex-plugin-cc,裝在 Claude Code 裡,一個指令就能叫 Codex 來審。兩種做法的前提一樣:電腦上要先裝好 Claude Code 與 Codex,兩邊都登入各自的帳號。反方向由 Codex 叫 Claude,目前我查到的是自己接,還沒有看到 Anthropic 推出對應的官方外掛。
- OpenAI 出了官方外掛,讓 Codex 能接到 Claude Code 一起工作|codex-plugin-cc:怎麼裝、哪個指令用在哪,以及兩家都會錯的一次實例。
- 怎麼設計讓兩個 AI 互審?:三種不同程度的審查機制設計:從只審結果到完整雙軌,三種強度怎麼挑。
三輪審稿和讀者走查,各抓到了什麼
| 關卡 | 判定 | 抓到的問題(節錄) |
|---|---|---|
| 讀者走查(三個人設) | 一個硬退件(標題承諾的東西正文沒給,一定要改) | 標題問「怎麼知道自己被牽著走」,正文只講「怎麼防」,沒有給判斷的方法。後來補了一段「四個訊號」 |
| 標題盲審 | 三個候選各有強弱 | 原本副標的「退出權」讀者看不懂;「資料留在自己手上」才接得住「機密資料能不能給 AI」這種搜尋 |
| Codex 第 1 輪 | 大修 | 重點表的時間碼用了段落起點,跟正文引用對不上;查證框只寫「另一家 AI 查過」,沒附來源;幾處整理者的語氣用了最高級 |
| Codex 第 2 輪 | 文章小修;技能包第一次送審,要改 | 「四個訊號」有幾句超出字幕內容;技能包缺「審完要修改、重跑、再送審」的閉環等,共 8 類修改 |
| Codex 第 3 輪 | 文章與技能包都通過 | 逐條確認上一輪的意見都處理了 |
第 1 輪審的其實是讀者走查之前的版本,所以時間碼那條在它回來之前已經改掉了。第 1 輪它抽查了 14 處引文與講者歸屬,全部和字幕一致。被抓到的問題包括:寫稿時加上去、字幕裡沒有的描述,查證沒附來源,時間碼對不準。
- 怎麼設計讓兩個 AI 互審?:三種不同程度的審查機制設計:這一段只講這一次實際怎麼審,那篇講審查的強度要怎麼依任務挑。
- 做完的東西想找人幫忙看,卻找不到人?|AI 使用者測試:這一段只講人設走查抓到什麼,那篇講人設怎麼設、問哪幾題。
單軌還是雙軌:現在看問題大小決定
以前我有兩種做法:單軌互審和雙軌互審。單軌是一個 AI 做完、另一個 AI 看過就出結果;雙軌是兩邊各自做、再互相審,就是上面那張圖的前半段。
說真的,我最近發現我很少用單軌互審。為什麼?因為現在模型夠聰明了,像 Opus 5.5 真是夠聰明的。比較簡單的,或者是不重要的問題,就直接 Opus 5.5 自己跑就好了,沒什麼大問題。比較複雜的或比較重要的,那就是直接雙軌互審。
| 情況 | 我現在的做法 |
|---|---|
| 比較簡單的,或不重要的問題 | Opus 5.5(Claude 目前的高階模型)自己跑就好 |
| 比較複雜的,或比較重要的問題 | 直接雙軌互審 |
| 單軌互審(一個做、一個審) | 最近很少用 |
AI 自己出錯、被抓到的地方
不到 40 分鐘跑完,不代表中間都沒出錯。這幾個是那晚實際發生、後來被抓出來的:
- 把審稿意見存成空檔案。(記在那晚的工作日記裡)第二輪意見回來後,Claude 用搜尋關鍵字的方式把意見擷取成檔案,關鍵字沒對到,存下來的是空的。它在送第三輪之前發現,停掉重送。如果沒發現,第三輪審稿者會讀到一份空的意見。
- 手機版的封面圖超出畫面。官網文章的範本裡有一行桌機的寬度設定,把手機的設定蓋掉了。截手機畫面才看出來;國泰那篇已經上線的文章也有同樣的問題,另外開了一張待辦處理。
- 新規則當下自己沒做到。審稿後技能包新增了一條「影片自己上傳的字幕也要抽查,對照影片聽一遍」,但那篇文章當晚沒做。隔天早上補做:抽三段各兩分鐘,用本機語音辨識轉一次,和字幕對照,內容一致。
- AI 交出一份很專業的分析,但它根本沒看過那支影片:這一段講的是流程抓到的小錯,那篇講為什麼一定要讓 AI 拿到真正的字幕或原文。
目標是下次一句話就夠:把這次的做法寫成技能包
我途中補的第三句「以後要有專題演講轉文章的模式」,讓 Claude 在交件前把整套做法寫成一個新的技能包模式(技能包就是寫給 AI 看的一份做事說明,下次它照著做)。技能包在文章第 2 輪時第一次送 Codex 審,被要求做 8 類修改,文章第 3 輪時技能包複審通過。
照實說,技能包這部分是單軌:Claude 寫、Codex 審,沒有兩邊各寫一版再比。雙軌只用在文章內容上。
寫進去的包括:
- 兩條路徑:只說「詳細拆解」就只做報告,做完問要不要轉文章;說「轉文章」就兩樣都做。
- 跟別的流程怎麼分:產品發布會、新聞事件走另一套趨勢文章流程;我自己的講座轉文章也另外有一套,因為要換成讀者不在現場的寫法。
- 紅線:引號內只放字幕原文;講者的推測不寫成事實;對特定公司的指控沒有來源就不放正文;整理者自己的判讀要標出來。
- 審稿閉環:審完要修改、重跑檢查、送回同一位審稿者;大修或讀者走查有硬退件,就不能交件;最多三輪,過不了就列選項給我決定。
技能包已經設計成:貼一個演講網址,說「專題演講轉文章」或「像國泰那樣拆解」就會觸發這一套。它還沒在下一支影片上實際跑過,要等下一次才算驗證。
- 每件事 AI 都要我確認,怎麼可以更自動?|什麼是迴圈工程:這一段是一個具體例子,那篇講迴圈工程本身:AI 做完自己檢查、發現問題自己修。
部署之後,是另一個迴圈:熟練的任務可以把好幾個迴圈接起來
上面那張動畫圖,我那條線最後一格紅色,就是準備部署。
唐鳳那篇就是這樣接下去的。隔天早上我說了一句「給我短版脆文+咪卡輪播卡,輪播卡做好後補回深度文章,然後部署」,一句話裡接了幾個迴圈:
| 時間 | 迴圈 | 做了什麼 |
|---|---|---|
| 09:56 | 脆文 | 寫 245 字的短版脆文,重點交給圖卡 |
| 09:56–10:17 | 輪播卡 | Claude 寫十張分鏡,Codex 生圖,Claude 逐張檢查角色、文字、版面,十張一次通過 |
| 09:58 起 | 上線前檢查 | 生圖的空檔,抽三段各兩分鐘的影片聲音,和字幕對照,內容一致(音訊 09:58–09:59 下載,抽查完成時間沒有留檔) |
| 10:17–10:20 | 補回文章、部署 | 十張卡放進文章對應的段落,10:20 上線,再自己打開正式網址檢查 |
時間取自檔案與發布紀錄。脆文和輪播卡目前是草稿,發到 Threads 還是我自己決定。
沒有這套系統,可以從哪裡開始
我那晚用的是 Claude 的桌面版加 Codex 的命令列工具,背後還有一個累積了很久的知識庫。你不用先有這些,下面三件事用網頁版的 ChatGPT、Claude 或 Gemini 就做得到:
電腦版 YouTube 的影片說明欄最下面,有些影片有「顯示轉錄稿」,打開後可以整段複製。也可以把網址丟進 Google 的 NotebookLM 讀影片。只給網址,AI 可能根本沒看到內容。
存成一份文件,下次附上它,說「照這份的格式做」。有 ChatGPT 或 Claude 的「專案」功能,就把它放進專案的檔案裡,每次對話都讀得到。
用 ChatGPT 寫的,就請 Claude 或 Gemini 審;反過來也行。把字幕一起給它,請它對照。公開影片沒問題;公司內部會議的逐字稿,先確認公司允不允許送到外部的 AI。
第一件可以用下面這段提示詞。字幕如果是 YouTube 自動產生的,人名、公司名和數字常常聽錯,先對照影片看個兩三段。字幕貼在後面,貼給你正在用的 AI:
下面是一支演講影片的字幕(每行開頭是時間碼)。請整理成一份逐段報告,規則如下: 1. 先寫一句話主旨,並標明這是你的判讀。 2. 依內容切成段落,每段寫:時間碼、說話的人、這段講了什麼。字幕沒寫是誰在說話的,依上下文判斷,判斷不了就寫「講者待確認」。 3. 加引號的句子只能用字幕原文,改寫過的不要加引號。一段內容橫跨好幾個時間點,就列出多個時間碼。 4. 講者提到的數字、產品、政策、事件,另外列一張「待查證」清單,不要當成已確認的事實。字幕如果是自動產生的,人名、公司名、數字全部列進這張清單。 5. 字幕缺漏、聽不清楚或看起來像打錯字的地方,標「字幕可疑」,不要自己補寫。 6. 最後分開寫:講者的主張、你自己的判讀。兩者不要混在一起。 字幕: (貼在這裡)
第三件可以用這段,請另一家 AI 審:
我附上兩樣東西:一份演講字幕,和另一個 AI 根據字幕寫的整理稿。請你當審稿人: 1. 抽查加引號的句子和時間碼(至少 10 處,稿子短就全部),對照字幕,看有沒有寫錯或講者歸錯。 2. 找出整理稿裡「字幕沒有、是 AI 自己加上去的」內容。 3. 找出把講者的推測寫成事實的地方。 4. 稿子裡提到的外部事實(數字、產品、政策、事件),能上網查的,優先查官方或原始來源,附連結與查閱日期;查不到就標「待查證」,不要猜。 5. 最後給一個判定:通過、小修、大修,並逐條列出位置和建議改法。 字幕: (貼在這裡) 整理稿: (貼在這裡)
審完照意見改,改完把新版和上一輪的意見一起給同一個 AI,請它逐條確認。這是單軌互審的簡化版本;要做到雙軌,就先讓兩家 AI 各自整理一份,再互相比對。
給你的 AI 讀的整理備忘(人可以跳過)
這一段寫給要引用這篇的 AI、研究者或顧問,交代資料怎麼來、哪些地方要小心。只想讀重點的人可以跳過;要引用或回查出處的人,請從這裡看。
- 這是一個歷史案例:描述 2026-09-28 晚上一次實際執行的流程,不是固定規格。流程依據江江教練知識庫中的技能包 quick-data-capture v0.4「專題演講轉文章 Loop」(該晚 22:47 跨家審通過的版本),之後可能再調整。
- 時間:取自檔案建立時間戳,精確到分鐘。字幕檔 22:12:21 下載,第三輪審稿紀錄 22:47:21 產生,兩者相減 35 分鐘。江江途中兩則補充訊息沒有時間戳,圖上位置依對話順序推估。
- 角色:主要執行者 Claude(Anthropic,Claude Opus 5.5);子代理為同一家模型另開的獨立對話,負責讀者人設走查與標題盲審;審稿者 Codex(OpenAI,gpt-5.6-sol),唯讀模式,指令中禁止把工作轉回 Claude。
- 數字:字幕 3985 行、45151 字(重算一致);報告逐段重點 43 段(影片說明欄官方章節 37 個);Codex 十個重點有 9 個對得上 Claude 的核心重點(其中「等待成本」Claude 併在「不能等市場」一點裡);引文與講者歸屬抽查 14 處一致;技能包第一次審稿 8 類修改。
- 單軌與雙軌那段:引自江江 2026-09-29 口述的觀點,不是通則。
想繼續聊這個
我每個月固定辦兩場免費線上講座,分享 AI 應用與知識管理的實戰做法。如果你也想讓 AI 一句話就接得住你的工作,歡迎先從社群開始。
這篇提到過的
- 每天用 AI,怎麼知道自己沒有被它牽著走?|唐鳳 × 丹增央措「對齊的另一面」對談重點整理
- Claude Skills 是什麼?把你的專業流程,變成 AI 能重複執行的知識資產
- 怎麼設計讓兩個 AI 互審?:三種不同程度的審查機制設計
- 做完的東西想找人幫忙看,卻找不到人?|AI 使用者測試
- AI 交出一份很專業的分析,但它根本沒看過那支影片
- 每件事 AI 都要我確認,怎麼可以更自動?|什麼是迴圈工程
再往前後延伸
- 公司導入 AI,資料要先整理到什麼程度?|2026 國泰金控技術年會 9 場演講整理:這篇一直提到的「上一次」,就是這篇。
- 如何讓兩個不同的 AI 互相挑錯、自己訂正?:同樣是雙軌互審,那篇用在企劃書上。