AI 工作流 · 迴圈工程

我怎麼一句話,就讓我的 AI 把一支專題影片變成一篇深度文章?|一句起手、途中補兩句:一支兩小時的演講影片,不到 40 分鐘跑完逐段報告、深度文章與兩家 AI 互相審稿

我丟了一個 YouTube 網址,說「能不能詳細拆解,像之前國泰直播的影片那種」。一句話能起手,是因為之前做過一次。不到 40 分鐘,我拿到一份逐段報告和一篇審過三輪的深度文章;途中我又補了兩句,其中一句讓它順便把整套做法寫成技能包,目標是下次一句話就夠。這篇把那一晚拆開給你看。

那一句話,和最後拿到的三樣東西

2026 年 9 月 28 日晚上,我在 Claude 的對話框貼了一支 YouTube 影片:唐鳳和丹增央措在 Platform 月台的公開對談,長 2 小時 17 分。我打的是:

起手那一句「能不能詳細拆解,像之前國泰直播的影片那種。」

照實說,它在跑的途中我又補了兩句:一句是「國泰直播我轉深度文章那樣」,把目標從報告拉到文章;另一句是「以後要有專題演講轉文章的模式,你順便寫技能包好嗎」。之後我就沒再下指令,等它交件。

最後拿到三樣東西:

產出是什麼放在哪
逐段觀點報告43 段逐段重點,每段有時間碼、講者、原話,加上待查證清單我的知識庫(自己回查用,不公開)
官網深度文章給讀者看的整理,十個重點、查證框、可複製的提示詞。當晚只做到本機預覽,隔天補上十張圖卡後才上線每天用 AI,怎麼知道自己沒有被它牽著走?
新技能包模式「專題演講轉文章」,設計成下次一句話就觸發,還要等下一支影片實際驗證我的技能包資料夾
先說清楚:這篇講的是那一次下面的時間點,有檔案時間戳的精確到分鐘(例如字幕 22:12 下載、報告 22:18 存檔、網頁 22:26 建立、三輪審稿的開始與結束);沒有時間戳的(第一個動作、我那兩句補充訊息、讀者走查回來的時間),是依執行順序推估,文中標「推估」。流程本身之後還會再調,這篇只描述 9 月 28 日那一次實際怎麼跑。

一張會動的圖,看完那 39 分鐘裡誰在做什麼

四條線由上到下是:我、Claude(Anthropic 公司的 AI,這次主要在做事的那個)、Claude 另外開的小幫手(叫「子代理」,是另開的一個對話,專門假扮讀者試讀、在不知道我偏好的情況下比較標題)、Codex(另一家公司 OpenAI 的 AI,我平常簡稱它 CX)。

先試一件事:拖到 22:15 左右,看看 Claude 和 Codex 是不是同時在跑、我在做什麼。每一個色塊都可以點,點開會浮出那一步的細節和時間紀錄。

22:11

圖例:實心色塊=正在做;斜線=在等別人;空白=沒事;點色塊看細節。線條顏色:我Claude子代理Codex

你剛才應該看到兩件事。第一,22:12 到 22:18 之間,Claude 自己在讀那 4.5 萬字的字幕、寫逐段報告,同一時間 Codex 在另一邊獨立挑重點、上網查證,兩邊互相看不到對方寫了什麼。第二,我那條線幾乎都是空的。起手一句、途中補兩句,其他時間都沒有再下指令。

一句話為什麼夠:AI 第一個動作是去翻上一次怎麼做

「像之前國泰直播的影片那種」這幾個字,才是那句話真正的份量。

9 月 15 日,我請 AI 把國泰金控技術年會一整天的直播整理成九份逐場報告;9 月 24 日,又把它做成一篇官網深度文章。那兩次都留下了檔案:報告放在知識庫的固定資料夾,做文章的過程另外寫成一份「證據檔」,記下標題怎麼定、讀者走查說了什麼、審稿改了哪幾條。

這次 Claude 收到那句話,第一個動作就是去找這些檔案:國泰的報告長什麼樣、分幾節,國泰那篇文章的網頁怎麼組、證據檔記了哪些項目。找到之後照著做。我不用再解釋一次「詳細拆解」是什麼意思。

所以一句話夠,是因為前面已經做過一次我給的是一個指向上一次成品的指令。上一次做得越完整、紀錄留得越清楚,下一次要講的話就越少。

除了前例,它還會讀我知識庫裡的規則檔:做深度文章要走哪些關卡、標題要先寫三個讀者會搜尋的句子、要找另一家 AI 審稿、審不過不能交件。這些規則是之前一次次踩坑後寫下來的,這次它照著跑。

把做法寫成 AI 能重複執行的檔案,我另外寫過

從貼網址到交件的八個步驟,一張表

有檔案時間戳的精確到分鐘;標「推估」的是依執行順序估的。

時間步驟誰做產出
22:11(推估)找前例:翻出國泰那次的報告和證據檔Claude知道要做成什麼樣子
22:12抓字幕:確認影片有頻道自己上傳的中文字幕,下載下來Claude3985 行、約 4.5 萬字的字幕
22:12–22:18兩軌同時跑:Claude 讀全文寫報告,Codex 獨立挑重點、上網查證Claude+Codex逐段報告;Codex 的十個重點與十項查證
22:13寫正文之前,先寫下三個讀者會搜尋的句子Claude工作標題
22:18–22:26重排成讀者看得懂的文章,組成官網網頁,截桌機與手機畫面Claude文章網頁初版
22:27–22:31(讀者走查結束時間推估)讀者走查(子代理假扮三種讀者試讀)、標題盲審(只給候選標題,不說我偏好哪個);同時送 Codex 第一輪審稿子代理+Codex一個硬退件、八個事實疑點、一份審稿意見
22:30–22:45逐條修改;寫新技能包模式;送 Codex 第二輪、第三輪Claude+Codex文章與技能包都修到通過
22:47–22:50第三輪通過,放上官網看板(我管理網站文章進度的清單)等我看,寫工作日記Claude交件

從 22:12 字幕下載,到 22:47 第三輪審稿回來,是 35 分鐘;從第一個動作(22:11,推估)到工作日記存檔(22:50),約 39 分鐘。

雙軌互審:我的 Claude 和 Codex 怎麼分工

這一部回答「AI 寫的東西,我怎麼確認它是對的」。

雙軌互審實際怎麼走:派工、各自跑、比對、整合、交叉審

先分清楚兩個詞。單軌互審是一家 AI 做、另一家看過再出結果;雙軌互審是兩家各自做一份,互相看不到對方的,做完再比對、整合,最後還要交叉審。那晚文章內容走的是雙軌,而且整個雙軌是 Claude 自己跑完的:我丟給它一個網址和一句話(途中另補兩句需求),派工給 Codex、比對、整合、送審都是它自己做,我沒有在兩家之間複製貼上。下面照實際順序拆開。按「播放」或「下一步」一步步看;上面綠色是 Claude,下面藍色是 Codex。

1 / 10
雙軌互審:我丟一個網址給 Claude,由 Claude 自己啟動雙軌,同一份字幕派給 Claude 與 Codex,各自跑、比對、整合,再由 Codex 審三輪、Claude 核對 Codex 的查證 我一個網址交給 Claude 一句話 A 軌|Claude B 軌|Codex 同一份字幕4.5 萬字 A B 互相看不到對方的稿 43 段逐段報告12 個重點23 項待查證 10 個重點查證 10 項8 處易寫錯 比對 兩家都有 9只有 Codex 1只有 Claude 4 整合一篇文章 送審 大修第 1 輪 意見 修 核對 Codex 的查證Claude 回頭核對 小修第 2 輪 修 通過第 3 輪 放上看板等我看

手機上圖比螢幕寬,可以左右滑動;每個圓圈和方框都可以點開看細節;播到第 10 步或按「完整圖」,整張流程會全部亮起來。

逐步文字版:五個階段與比對清單
1
派工|22:12

同一份字幕,同時交給兩家。Claude 自己讀;給 Codex 的指令只附字幕檔,不給 Claude 寫到一半的東西,並寫明不要把工作轉交給 Claude。

2
兩家各自跑|22:12–22:18,互相看不到對方
A 軌|Claude讀完 4.5 萬字,寫逐段報告
  • 43 段逐段重點,每段有時間碼、講者、原話
  • 12 個核心重點
  • 23 項待查證(只列出來,沒有查)
B 軌|Codex讀同一份字幕,挑重點、上網查
  • 10 個重點,每點附時間碼與講者判斷依據
  • 上網查證 10 項台上說法,附來源網址
  • 8 處容易寫錯的名稱與數字
3
比對結果

把兩邊的重點一條一條對起來。計算方式:同一件事,一家拆成兩點、另一家併成一點,算兩家都有。

兩家都有(9)
  • AI 讓下游也能改上游(反向對齊)
  • 不能等市場自己解決,以及等待的成本由誰承擔(Codex 拆成兩點,Claude 併成一點)
  • 台灣經驗:共識三週、制度三年
  • AI 會向上管理,人只剩蓋章
  • 新人還學得到:中間的紀錄看得懂
  • 撞牆經驗寫成技能分享
  • 「AI 生成」標籤不夠
  • 先接住被遺漏的人
只有 Codex 列為重點(1)
  • 安燈繩(Claude 只寫在逐段內容,沒列成重點)
只有 Claude 列為重點(4)
  • 模型也要有版本號
  • 馬和馬鞍交給不同家
  • 不要跟馬賽跑(職場)
  • 個人要有驗證和退出的權利
查證這一欄也對起來:Claude 列了 23 項待查證但沒查;Codex 獨立查了 10 項台上說法,2 項一致、8 項部分一致,多半是台上講得比實際更強。
4
整合成一篇文章|Claude

兩家都有的 9 點當主幹;Codex 多的 1 點、Claude 多的 4 點各自寫成一段;Codex 的查證寫成 7 個查證框,放在文章對應的段落;來源連結是第 1 輪審稿指出後才補上。

5
交叉審:兩個方向都要審
Codex 審 Claude文章審三輪
  • 第 1 輪:大修
  • 第 2 輪:小修
  • 第 3 輪:通過
Claude 審 Codex查證不照抄
  • 一個服務的價格與隱私說明兩點,自己打開官方網頁再核對一次
  • 8 個來源網址逐一確認打得開
另外一道同家自查:Claude 的子代理假扮三種讀者試讀、盲審三個候選標題,抓到「標題承諾的東西正文沒給」。
↓
放上官網看板,等我看

幾個設計上的重點:

  • B 軌拿不到 A 軌的草稿。兩個 AI 如果先看到對方的答案,很容易順著對方寫,比對就沒有意義了。
  • 比對時看重疊,也看各自多出來的。兩家都列到的 9 點,比較有把握是整場的主幹;各自多出來的 5 點,是單靠一家容易漏掉的東西。
  • 查證交給不寫稿的那一家,寫稿的那一家再回頭核對。這就是「交叉」:Codex 審 Claude 的文章,Claude 也審 Codex 的查證。
  • 審稿找另一家公司的 AI。寫稿的是 Anthropic 的 Claude,審稿的是 OpenAI 的 Codex,希望降低兩邊有同樣盲點的機會。
  • 同一位審稿者審到底。第二輪、第三輪都把上一輪的意見一起附上,請它逐條確認改了沒。
想知道 Claude 怎麼自己叫 Codex,不用我來回貼

這次是 Claude 在我的電腦上直接用命令列叫 Codex,派工、收結果、再送審都由它自己來。OpenAI 在 2026 年 3 月也推出了官方外掛 codex-plugin-cc,裝在 Claude Code 裡,一個指令就能叫 Codex 來審。兩種做法的前提一樣:電腦上要先裝好 Claude Code 與 Codex,兩邊都登入各自的帳號。反方向由 Codex 叫 Claude,目前我查到的是自己接,還沒有看到 Anthropic 推出對應的官方外掛。

三輪審稿和讀者走查,各抓到了什麼

關卡判定抓到的問題(節錄)
讀者走查(三個人設)一個硬退件(標題承諾的東西正文沒給,一定要改)標題問「怎麼知道自己被牽著走」,正文只講「怎麼防」,沒有給判斷的方法。後來補了一段「四個訊號」
標題盲審三個候選各有強弱原本副標的「退出權」讀者看不懂;「資料留在自己手上」才接得住「機密資料能不能給 AI」這種搜尋
Codex 第 1 輪大修重點表的時間碼用了段落起點,跟正文引用對不上;查證框只寫「另一家 AI 查過」,沒附來源;幾處整理者的語氣用了最高級
Codex 第 2 輪文章小修;技能包第一次送審,要改「四個訊號」有幾句超出字幕內容;技能包缺「審完要修改、重跑、再送審」的閉環等,共 8 類修改
Codex 第 3 輪文章與技能包都通過逐條確認上一輪的意見都處理了

第 1 輪審的其實是讀者走查之前的版本,所以時間碼那條在它回來之前已經改掉了。第 1 輪它抽查了 14 處引文與講者歸屬,全部和字幕一致。被抓到的問題包括:寫稿時加上去、字幕裡沒有的描述,查證沒附來源,時間碼對不準。

兩個 AI 互審的三種強度,我另外排過

單軌還是雙軌:現在看問題大小決定

以前我有兩種做法:單軌互審和雙軌互審。單軌是一個 AI 做完、另一個 AI 看過就出結果;雙軌是兩邊各自做、再互相審,就是上面那張圖的前半段。

說真的,我最近發現我很少用單軌互審。為什麼?因為現在模型夠聰明了,像 Opus 5.5 真是夠聰明的。比較簡單的,或者是不重要的問題,就直接 Opus 5.5 自己跑就好了,沒什麼大問題。比較複雜的或比較重要的,那就是直接雙軌互審。

情況我現在的做法
比較簡單的,或不重要的問題Opus 5.5(Claude 目前的高階模型)自己跑就好
比較複雜的,或比較重要的問題直接雙軌互審
單軌互審(一個做、一個審)最近很少用
流程不是一定的會隨著環境、需求、模型能力成長而變動。這篇畫出來的是 9 月 28 日那一次的樣子:文章用了雙軌,技能包其實用了單軌。換一個題目、換一代模型,我可能又會調。

AI 自己出錯、被抓到的地方

不到 40 分鐘跑完,不代表中間都沒出錯。這幾個是那晚實際發生、後來被抓出來的:

  • 把審稿意見存成空檔案。(記在那晚的工作日記裡)第二輪意見回來後,Claude 用搜尋關鍵字的方式把意見擷取成檔案,關鍵字沒對到,存下來的是空的。它在送第三輪之前發現,停掉重送。如果沒發現,第三輪審稿者會讀到一份空的意見。
  • 手機版的封面圖超出畫面。官網文章的範本裡有一行桌機的寬度設定,把手機的設定蓋掉了。截手機畫面才看出來;國泰那篇已經上線的文章也有同樣的問題,另外開了一張待辦處理。
  • 新規則當下自己沒做到。審稿後技能包新增了一條「影片自己上傳的字幕也要抽查,對照影片聽一遍」,但那篇文章當晚沒做。隔天早上補做:抽三段各兩分鐘,用本機語音辨識轉一次,和字幕對照,內容一致。
這些錯誤是怎麼被發現的前兩個是當晚發現的:截手機畫面時看到版面問題,送第三輪前檢查意見檔時看到空檔案。字幕抽查是審稿後新增的規則,當晚沒做,隔天才補。
AI 說它看過影片,其實沒看,我另外寫過

目標是下次一句話就夠:把這次的做法寫成技能包

我途中補的第三句「以後要有專題演講轉文章的模式」,讓 Claude 在交件前把整套做法寫成一個新的技能包模式(技能包就是寫給 AI 看的一份做事說明,下次它照著做)。技能包在文章第 2 輪時第一次送 Codex 審,被要求做 8 類修改,文章第 3 輪時技能包複審通過。

照實說,技能包這部分是單軌:Claude 寫、Codex 審,沒有兩邊各寫一版再比。雙軌只用在文章內容上。

寫進去的包括:

  • 兩條路徑:只說「詳細拆解」就只做報告,做完問要不要轉文章;說「轉文章」就兩樣都做。
  • 跟別的流程怎麼分:產品發布會、新聞事件走另一套趨勢文章流程;我自己的講座轉文章也另外有一套,因為要換成讀者不在現場的寫法。
  • 紅線:引號內只放字幕原文;講者的推測不寫成事實;對特定公司的指控沒有來源就不放正文;整理者自己的判讀要標出來。
  • 審稿閉環:審完要修改、重跑檢查、送回同一位審稿者;大修或讀者走查有硬退件,就不能交件;最多三輪,過不了就列選項給我決定。

技能包已經設計成:貼一個演講網址,說「專題演講轉文章」或「像國泰那樣拆解」就會觸發這一套。它還沒在下一支影片上實際跑過,要等下一次才算驗證。

讓 AI 自己跑完一整圈,我另外寫過

部署之後,是另一個迴圈:熟練的任務可以把好幾個迴圈接起來

上面那張動畫圖,我那條線最後一格紅色,就是準備部署。

我的習慣部署之後又是另外一個新的迴圈,整個部署又是一個迴圈。其實也可以全部跑完,但是因為我的習慣是我還是會稍微看過一下,沒問題再部署。但如果有些是比較熟練的任務,其實是可以把好幾個迴圈接在一起的,比如說這個我就說部署,然後另外生圖卡、生脆文等等之類的。

唐鳳那篇就是這樣接下去的。隔天早上我說了一句「給我短版脆文+咪卡輪播卡,輪播卡做好後補回深度文章,然後部署」,一句話裡接了幾個迴圈:

時間迴圈做了什麼
09:56脆文寫 245 字的短版脆文,重點交給圖卡
09:56–10:17輪播卡Claude 寫十張分鏡,Codex 生圖,Claude 逐張檢查角色、文字、版面,十張一次通過
09:58 起上線前檢查生圖的空檔,抽三段各兩分鐘的影片聲音,和字幕對照,內容一致(音訊 09:58–09:59 下載,抽查完成時間沒有留檔)
10:17–10:20補回文章、部署十張卡放進文章對應的段落,10:20 上線,再自己打開正式網址檢查

時間取自檔案與發布紀錄。脆文和輪播卡目前是草稿,發到 Threads 還是我自己決定。

沒有這套系統,可以從哪裡開始

我那晚用的是 Claude 的桌面版加 Codex 的命令列工具,背後還有一個累積了很久的知識庫。你不用先有這些,下面三件事用網頁版的 ChatGPT、Claude 或 Gemini 就做得到:

第一件讓 AI 拿到真正的字幕

電腦版 YouTube 的影片說明欄最下面,有些影片有「顯示轉錄稿」,打開後可以整段複製。也可以把網址丟進 Google 的 NotebookLM 讀影片。只給網址,AI 可能根本沒看到內容。

第二件第一次做好之後,把成品存成檔案

存成一份文件,下次附上它,說「照這份的格式做」。有 ChatGPT 或 Claude 的「專案」功能,就把它放進專案的檔案裡,每次對話都讀得到。

第三件請另一家 AI 看一遍

用 ChatGPT 寫的,就請 Claude 或 Gemini 審;反過來也行。把字幕一起給它,請它對照。公開影片沒問題;公司內部會議的逐字稿,先確認公司允不允許送到外部的 AI。

第一件可以用下面這段提示詞。字幕如果是 YouTube 自動產生的,人名、公司名和數字常常聽錯,先對照影片看個兩三段。字幕貼在後面,貼給你正在用的 AI:

下面是一支演講影片的字幕(每行開頭是時間碼)。請整理成一份逐段報告,規則如下:

1. 先寫一句話主旨,並標明這是你的判讀。
2. 依內容切成段落,每段寫:時間碼、說話的人、這段講了什麼。字幕沒寫是誰在說話的,依上下文判斷,判斷不了就寫「講者待確認」。
3. 加引號的句子只能用字幕原文,改寫過的不要加引號。一段內容橫跨好幾個時間點,就列出多個時間碼。
4. 講者提到的數字、產品、政策、事件,另外列一張「待查證」清單,不要當成已確認的事實。字幕如果是自動產生的,人名、公司名、數字全部列進這張清單。
5. 字幕缺漏、聽不清楚或看起來像打錯字的地方,標「字幕可疑」,不要自己補寫。
6. 最後分開寫:講者的主張、你自己的判讀。兩者不要混在一起。

字幕:
(貼在這裡)

第三件可以用這段,請另一家 AI 審:

我附上兩樣東西:一份演講字幕,和另一個 AI 根據字幕寫的整理稿。請你當審稿人:

1. 抽查加引號的句子和時間碼(至少 10 處,稿子短就全部),對照字幕,看有沒有寫錯或講者歸錯。
2. 找出整理稿裡「字幕沒有、是 AI 自己加上去的」內容。
3. 找出把講者的推測寫成事實的地方。
4. 稿子裡提到的外部事實(數字、產品、政策、事件),能上網查的,優先查官方或原始來源,附連結與查閱日期;查不到就標「待查證」,不要猜。
5. 最後給一個判定:通過、小修、大修,並逐條列出位置和建議改法。

字幕:
(貼在這裡)

整理稿:
(貼在這裡)

審完照意見改,改完把新版和上一輪的意見一起給同一個 AI,請它逐條確認。這是單軌互審的簡化版本;要做到雙軌,就先讓兩家 AI 各自整理一份,再互相比對。

給你的 AI 讀的整理備忘(人可以跳過)

這一段寫給要引用這篇的 AI、研究者或顧問,交代資料怎麼來、哪些地方要小心。只想讀重點的人可以跳過;要引用或回查出處的人,請從這裡看。

  • 這是一個歷史案例:描述 2026-09-28 晚上一次實際執行的流程,不是固定規格。流程依據江江教練知識庫中的技能包 quick-data-capture v0.4「專題演講轉文章 Loop」(該晚 22:47 跨家審通過的版本),之後可能再調整。
  • 時間:取自檔案建立時間戳,精確到分鐘。字幕檔 22:12:21 下載,第三輪審稿紀錄 22:47:21 產生,兩者相減 35 分鐘。江江途中兩則補充訊息沒有時間戳,圖上位置依對話順序推估。
  • 角色:主要執行者 Claude(Anthropic,Claude Opus 5.5);子代理為同一家模型另開的獨立對話,負責讀者人設走查與標題盲審;審稿者 Codex(OpenAI,gpt-5.6-sol),唯讀模式,指令中禁止把工作轉回 Claude。
  • 數字:字幕 3985 行、45151 字(重算一致);報告逐段重點 43 段(影片說明欄官方章節 37 個);Codex 十個重點有 9 個對得上 Claude 的核心重點(其中「等待成本」Claude 併在「不能等市場」一點裡);引文與講者歸屬抽查 14 處一致;技能包第一次審稿 8 類修改。
  • 單軌與雙軌那段:引自江江 2026-09-29 口述的觀點,不是通則。

想繼續聊這個

我每個月固定辦兩場免費線上講座,分享 AI 應用與知識管理的實戰做法。如果你也想讓 AI 一句話就接得住你的工作,歡迎先從社群開始。

江江教練

隱性知識提煉師、AI 應用規劃師

加入 LINE 社群 →

看服務方案 →