AI 工作流 / 新模型

AI 換新版,下指令的方式要跟著改嗎?|Opus 5.5 官方指南,知識工作者也用得到的 7 招

Anthropic 為新模型出的官方指南看起來是寫給工程師的,但大半在講同一件事:怎麼把工作交代清楚,讓 AI 自己做下去。不寫程式的知識工作者也可以參考。

咪卡坐在主播台播報:新版 Claude 怎麼下指令?官方指南整理 7 招
這組咪卡輪播卡共 9 張,內文每一招各放一張

這篇在講什麼

Anthropic 替新模型 Claude Opus 5.5 出了一份官方的下指令指南。內容看起來是寫給工程師的,有參數、有 API,但拆開來看,很多段落講的其實是同一件事:怎麼把工作交代清楚,讓 AI 自己做下去。這篇挑出 7 招,用白話講一遍,每一招附上我自己的工作怎麼用、可以直接複製的指令,最後補一招我自己的:換新模型,就把常做的工作重測一次。

適合誰
  • 不寫程式,但每天用 AI 寫稿、整理資料、做簡報的知識工作者
  • 聽說 AI 又出新版,想知道自己下指令的習慣要不要跟著改的人
  • 要帶同事或客戶用 AI,想有一套說得清楚的交代方法的人
你可以帶走什麼
  • 官方指南裡,不寫程式也用得到的 7 招,每招一句白話
  • 四段可以直接複製的指令:講清楚終點、什麼時候才停、留工作日誌、分工驗收
  • 一個換模型時的做法:拿固定幾件工作重跑一次,看有沒有走樣

官方這份 Opus 5.5 指南在講什麼

Anthropic 這次為 Claude Opus 5.5 出了一份提示詞指南,說明這一代模型跟上一代有什麼不同、指令要怎麼調,叫 Prompting Claude Opus 5.5。

內容大多寫給串接 API 的開發者,也有段落講 Claude Code 和聊天產品,所以裡面有很多參數名稱。把參數拿掉,剩下的內容大致分成三類:

類別官方在講什麼不寫程式的人用不用得到
設定怎麼調推理程度(effort)預設改成中等;在 Claude Code 裡中途切換不會清掉暫存用 Claude Code 的人用得到,一般聊天介面看不到這個設定
舊習慣要刪不用再叫它「仔細思考」、不要叫它把腦中過程寫出來用得到,改的是你寫的字
工作怎麼交代講清楚做完的樣子、規定什麼時候才停、留清單、分給子代理、給時間預算最用得到,這就是交代工作的方法

第三類是這篇的主角。官方寫它,是因為新模型很會做又長又多步驟的工作,但前提是你把工作交代清楚。這件事跟會不會寫程式無關。

我怎麼看:不只工程師,知識工作者也可以參考

這份指南不只是工程師可以用,知識工作者也可以參考。對照一下,官方這次寫的幾個重點,剛好可以對上我在官網寫過的幾篇文章:

官方指南怎麼說我之前在哪裡寫過
一次講清楚任務、做完的樣子、什麼時候停意圖優先:把你要什麼講清楚,剩下交給 AI
刪掉為舊模型寫的指令,例如「請仔細思考」舊提示詞不必丟:用它提煉意圖,不再照步驟寫死
規定什麼時候才停,讓它自己往下做從提示詞工程到迴圈工程:設計一個會自己跑的循環
長任務把待辦寫在檔案裡3X4 資料整理法:寫日記,讓 AI 讀得懂你的工作
大任務拆給子代理什麼叫子代理:分頭工作後再一起整併

所以這篇不是要你重學一套新方法。官方指南剛好可以當一份對照表,檢查自己交代工作的習慣有沒有跟上新模型。

一句話每次換新模型,技能包和常做的任務都要再微調一次。官方指南告訴你這次要調哪裡。

第一招:一次講清楚終點

咪卡跑向終點拱門:一次講清楚終點,寫清楚要做什麼、做完長什麼樣、什麼狀況要停下來問
第 2 招輪播卡:一次講清楚終點

官方說,新模型最擅長的是多步驟的長工作,但前提是它知道做到哪裡才算完。只丟一句「幫我整理這些資料」,它不知道要整理到什麼程度,就會在它覺得差不多的地方停下來。

交代時,一則訊息講完三件事:

  1. 要做什麼
  2. 做完長什麼樣子
  3. 碰到什麼狀況要停下來問你

可以直接複製的版本:

要做的事:把這個資料夾裡的會議紀錄整理成一份待辦清單。 做完的樣子:每一條待辦都有負責人、期限、出自哪一場會議;重複的合併成一條。 什麼時候停下來問我:看不出負責人是誰、或兩場會議講的期限互相矛盾的時候。其他的你自己判斷做完。

這跟我在意圖優先那篇講的是同一件事:把為什麼做、做到什麼程度講清楚,方法留給 AI。

第二招:給它標準,讓它自己做下去

新模型有個新習慣:邊做邊跟你報告進度。報告本身是好事,問題是有時候報告完,那一輪就停了,等你說「繼續」。

官方給的範例指令裡,點名了四種它會停下來的方式:

  • 寫一大段總結,說下一步要做什麼,然後沒做
  • 客氣地問你要不要繼續
  • 丟一堆選項給你選,但那些選項其實不影響它往下做
  • 覺得做到一個段落了,就停下來報告
咪卡開小火車一路綠燈,只在缺資料、要刪東西兩站停:給它標準,讓它自己做下去
第 5 招輪播卡:給它標準,讓它自己做下去

解法是直接給它停下來的標準。可以直接複製的版本:

不需要我決定的步驟,請直接繼續做,進度報告跟下一步動作寫在同一則訊息裡。 只有兩種情況才停下來問我: 1. 缺資料,沒有我就沒辦法繼續 2. 要刪東西、要對外送出、或要動到這個專案以外的檔案

我自己的 AI 規則檔就是這樣寫的:機械性的動作直接做,不可逆、對外送出、跟錢有關、會刪掉東西的,一律要我當次點頭。標準寫清楚,它就知道哪些可以自己往下走。

這段指令適合你不在旁邊的長任務官方特別說明,這段是寫給「讓 AI 自己跑、沒人在旁邊回應」的情境。如果你就坐在電腦前一來一回地跟它討論,不用加。另外,既然放手讓它往下衝,刪除、送出這類動作的確認一定要留著。

第三招:長任務留工作日誌加待辦清單

咪卡在登山營地寫日誌,背包上掛著打勾的待辦清單:長任務留工作日誌加待辦清單
第 6 招輪播卡:長任務留工作日誌+待辦清單

官方提醒:它停下來講的那段話,只是在回報,不代表工作做完了。

對話一長,AI 能記住的量有上限,Claude Code 會把前面的內容濃縮成摘要。待辦清單如果只留在聊天紀錄裡,細節可能在濃縮時被省略。寫在一個獨立的檔案裡,檔案本身不會被改寫,之後隨時可以叫它重新讀。

它停下來的時候,你打開那個檔案看一眼,還有幾項沒打勾,直接點名叫它繼續就好。

可以直接複製的版本:

請建立一個工作日誌檔案,邊做邊記:今天做了什麼、做到哪裡、下一步是什麼。 另外列一份待辦清單,做完一項就打勾一項,發現新的工作就加進去。

官方講的是待辦清單,我會再加上工作日誌。待辦清單記「還剩什麼」,工作日誌記「做到哪、為什麼這樣做」,換一個對話、甚至換一台電腦,AI 讀了日誌就能接著做。怎麼寫日記讓 AI 讀得懂,我在 3X4 資料整理法那篇有完整講。

第四招:分工給子代理,回來要驗收

工作量很大的時候,可以叫 AI 開分身,也就是子代理(subagent),每個分身負責一小塊,做完回來報告。官方舉的例子是大型專案的稽核、搬遷、大範圍檢查。

知識工作者也有這種工作:同時查三個方向的資料、替三十位學員各做一頁成果、把一百份文件逐份摘要。

這招需要能開子代理的工具,例如 Claude Code;一般的聊天視窗通常做不到。

重點在驗收。分身說做完了,不代表真的做完。主 AI 如果分身回報什麼就信什麼,分身犯的錯就會一路帶進最後的成果。

咪卡在倉庫用放大鏡核對三隻小分身送來的箱子:分工也要驗收,每一項都要附證據
第 7 招輪播卡:分工也要驗收

可以直接複製的版本:

請把這件工作拆給子代理,一個子代理負責一塊。 每個子代理回報時,要附上它根據的證據(出處、原文、檔名)。 你先檢查證據再接受,最後整理成一張表:每一塊的結果、證據、有沒有問題。

我自己的做法再多一層:AI 寫的東西,交給另一家公司的 AI 審,不讓同一家自己審自己。這篇文章送出前也走了這一步。

另外三招:推理程度、別叫它仔細想、設計說不要什麼

這三招比較短,一張表講完,各附一張輪播卡。

招式白話說明怎麼做
推理程度不用開最高新版預設就是中等。官方測試,開中等已經跟舊版開高一樣好;同一個等級,新版想得比舊版多在 Claude Code 輸入 /effort 選 medium,再拿常做的工作試低、中、高,選夠用的最低檔
別再叫它「仔細想」新版的思考功能一直開著,想多久它自己判斷。官方在聊天產品裡測過,拿掉這句回覆開始得比較快,品質沒有明顯下降刪掉「請仔細思考」「一步一步想」。想知道理由,就請它用三句話說明
設計要說「不要什麼」只說「不要有 AI 味」太模糊,它只會從一種老套換成另一種直接點名:不要米白底、斜體標題、01 02 03 編號、膠囊按鈕。做完看它換成什麼,不喜歡就再加進清單
咪卡把瓦斯爐從大火轉到中火:推理程度不用開最高
第 1 招:推理程度不用開最高
咪卡把寫著請仔細想的紙條丟進垃圾桶:別再叫它仔細想
第 3 招:別再叫它「仔細想」
叫它寫出腦中的思考過程,可能會被擋官方提到,如果指令要求它把內部的思考過程完整寫在回覆裡,這個請求可能會被安全檢查拒絕。要理由就直接問理由,例如「用三句話說明你為什麼選這個做法」。

我補的一招:換模型就重測

咪卡在車庫用技能包工具箱調整新模型小車:換模型就重測
第 8 招輪播卡:換模型就重測

官方指南有一句話很重要:不要把舊模型的設定直接搬過來,拿你自己的任務重新測過。

我的看法是,每次換新模型,技能包和常做的任務都要再微調一次。同一套指令,換了模型,結果可能變好,也可能走樣。

做法很簡單:挑幾件固定的工作,每次換模型就重跑一次,比對結果。有走樣的地方,就調整那份指令。

我在同一份考卷考三輪那篇寫過一次完整的過程:一個每天整理 LINE 群訊息的小工具,用同一份 138 則訊息的考卷評估了三輪,新模型出來就重考一次,最後預估月費從大約 83 元降到大約 6 到 13 元。

給你的 AI 讀的技術備忘(人可以跳過)

以下是官方文件裡的技術細節,給要串接或設定的人,也可以整段貼給你的 AI。

  • Opus 5.5 的 effort 預設是 medium(Opus 5 是 high);官方測試 medium 在寫程式與知識工作評測上打平或超過 Opus 5 的 high,xhigh 與 max 建議只在實測有品質提升時才用。
  • API 上中途改「最上層」的 effort 會讓 prompt cache 失效;Opus 5.5 支援逐則訊息改 effort(beta),可保留 cache。Claude Code 用 API key 或 Claude 訂閱時,切換 effort 不清 cache、不再跳確認;Amazon Bedrock、Google Cloud、Claude apps gateway 不適用。
  • 要求模型在回覆裡重現內部推理,可能以 reasoning_extraction 類別被拒;官方建議改讀 summarized thinking,或請它給簡短理由。
  • 無人看管的長任務:文字結尾的回合要當成「回報」不是「完成」;清單放待辦工具或檔案;自動續跑同一任務兩到三次後要停,避免卡死時無限重試。
  • 多代理:給時間預算(例如每則訊息附 elapsed 340s / 1200s)可讓團隊更快完成;預算只是參考,需要硬性截止要自己設 timeout。
  • Claude Code v2.1.277 起,資料夾裡沒有 CLAUDE.md 時會讀 AGENTS.md;兩者都要讀可在設定改 Project instructions。

來源:Prompting Claude Opus 5.5、Effort、Claude Code prompt caching、Claude Code memory。內容整理時參考了 Gary Chen 的影片整理,事實以官方文件為準。