翼王資訊社

知識分享 · AI 模型

新模型的心法:哪些舊建議現在反而是錯的

Claude Fable 5 與 Opus 5 出來之後,有幾條先前的標準做法被直接推翻 —— 不是補充,是反過來。整理三個最容易踩到的反轉、一個會讓工具靜默沒跑的坑,以及一張新舊對照速查表。

翼王資訊社 · 知識分享 2026-07-26

這篇會過期。整理時間是 2026 年 7 月,講的是 Claude Fable 5 與 Claude Opus 5 當下的官方建議。模型每隔幾個月就換一代,而這篇的重點正好是「上一代的建議會被推翻」—— 所以它自己也會被推翻。動手改你的提示詞前,請以頁尾列出的官方文件為準。
Part 01 · 定位

先看定位:兩台新模型是什麼關係

這兩台不是「大的跟小的」,而是兩種用途。價格差一倍,但便宜那台不是縮水版 —— Opus 5 是與前一代 Opus 4.8 同價的升級,Fable 5 則是把最難的問題丟進去的那一台。

Claude Opus 5 claude-opus-5 $5 / $25 每百萬 tokens · 日常主力 · 複雜的 agentic coding · 與 Opus 4.8 同價的升級 Claude Fable 5 claude-fable-5 $10 / $50 每百萬 tokens · 最強的公開模型 · 最難、還沒解掉的問題 · 思考永遠開著,關不掉 兩台都是 100 萬 token 的 context、最多輸出 128K tokens 更便宜的層級還有 Claude Sonnet 5 與 Claude Haiku 4.5

價格是每百萬 tokens 的輸入/輸出費用。Fable 5 貴一倍,但它負責的是另一種題目。

怎麼選:日常用 Opus 5。當你手上有一個已經卡住、不知道怎麼下手的難題,才換 Fable 5 —— 官方觀察到成效最好的團隊,是直接把還沒解掉的難題丟給它,讓它先界定問題再執行。

兩個只有寫程式呼叫 API 才會碰到的限制

  • Fable 5 需要 30 天的資料保留。設定為零資料保留(ZDR)的組織,每一個請求都會被擋掉,不管內容多正常。
  • Fable 5 的思考關不掉;Opus 5 可以關,但只有在 effort 設在 high 或更低時才允許。

下面幾節講的是提示詞層面的心法 —— 不管你是在 Claude Code 裡打字、還是自己寫程式呼叫,都適用。

Part 02 · 反轉一

反轉一:把「請再檢查一次」刪掉

這條最值得記,因為它推翻的是一條通用的提示詞最佳實踐。「叫 AI 自己檢查一遍」以前幾乎是萬用招,現在在 Opus 5 上會反過來咬你。

原因很單純:Opus 5 不用你講就會自己驗收。你再叫它驗,它就驗第二次、第三次。

以前 提示詞寫 「最後請再檢查一次」 模型照著做 驗證一次,剛好 現在 同樣那句話 「最後請再檢查一次」 它本來就會 自己驗一次 驗兩次以上 多花時間與費用 修法是把那句話刪掉 —— 官方明說移除之後不會掉能力

這是「刪除」,不是「改寫」。不用換句話說,就是整句拿掉。

# 以前這樣寫,現在請刪掉 完成後請再檢查一次你的答案。 最後加一個驗證步驟。 開一個 subagent 來檢查你的成果。 # 什麼都不用加。它自己會驗。
這跟「給它一個能自己驗收的方法」衝突嗎?不衝突。我們上一篇整理過 Claude Code 作者的建議:給它單元測試、給它截圖工具,它就會自己迭代。那條講的是給它工具;這條講的是別再用提示詞催它驗證。給工具,別碎念。
Part 03 · 反轉二

反轉二:subagent 的建議整個翻面

這條是字面上的方向相反,而且相隔只有一代:

  • Opus 4.8:太少用 subagent。官方建議是加提示詞鼓勵它委派,因為它不太願意把工作分出去。
  • Opus 5:太愛用 subagent。官方建議是把那些鼓勵的話拿掉,而且加上明確的上限。

為什麼要管:每開一個 subagent,它都要重新建立自己的脈絡、重新摸索一遍、然後回報,而主流程還要再讀一次那份回報。成本與時間是相乘的,不是相加的。

# 為 Opus 4.8 寫的這種話,在 Opus 5 上要拿掉 盡量把獨立的工作分給 subagent 平行處理。 # 改成給它界線 你自己幾個步驟就能做完的事,不要開 subagent。 驗證不要交給 subagent,在你自己的流程裡做完。 一件事能用一個 subagent 完成,就不要開多個。 除非我明確要求,平行的 subagent 不要超過 20 個。
注意上面第二句。「驗證不要交給 subagent」跟反轉一是同一件事的兩個角度 —— 它本來就會驗,你不需要另外開一個人去檢查它。
Part 04 · 反轉三

反轉三:想要短就寫提示詞,別去調 effort

Opus 5 預設話比較多 —— 回覆更長,寫到磁碟的檔案也更長(報告、說明文件、摘要都是)。很多人的第一反應是把 effort 調低,想讓它「少想一點、少講一點」。

這招不管用。調 effort 會改變它思考的量,但不會可靠地縮短你看到的輸出。想要短,就直接說。官方實測:一句簡短的簡潔指令,把使用者看到的回覆長度砍掉約 20%
# 對話回覆想要短 回答保持精簡,把篇幅放在主要答案上,免責與補充講重點就好。 要你解釋時,先給高層次的摘要,除非我明確要求細節。 # 它寫的檔案想要短(這是另一件事,要另外講) 寫成檔案的東西,長度要配合任務需要:把該講的講完, 但不要用湊數的章節、重複的摘要或樣板把文件撐長。

那 effort 到底怎麼選?

這裡也有一條反轉:以前很多人反射性地把 effort 拉到最高,想榨出最高的智慧。新模型的天花板本來就更高,所以起點該往下移,然後往下掃

其他工作 起點 coding/agentic 起點 low 短任務 · 低延遲 medium 省成本的第一階 high 預設值 xhigh coding 最佳 max 最難且不趕時間 然後往下掃 —— low/medium 在新模型上強得不合常理 舊模型調好的 effort 設定,幾乎都不該直接搬過來

起點在藍框或紫框,方向往左。不是「拉到 max 最安全」。

Part 05 · 靜默失敗

一個會靜默失敗的坑:關掉思考

為了省錢或省時間把思考關掉(Opus 5 允許,前提是 effort 在 high 或更低),會換來一個很難發現的問題。

你關掉思考 工具呼叫被寫成 一般文字 那一輪正常結束 工具沒跑 · 沒有錯誤訊息 假文字留在對話裡,汙染後面幾輪 最省事的修法:思考開著,改用低 effort 控成本

最難處理的不是它做錯,是它沒報錯。你會以為那一步做過了。

還有一個副作用:關掉思考之後,內部的 <thinking> 標籤有機會漏進使用者看到的回覆裡。而這兩件事的修法都反直覺:

  • 把「不要思考」「不要推理」這類指令刪掉。那種話反而讓標籤更容易漏出來,不是壓下去。
  • 不要指名標籤。寫「不要輸出內部或系統的 XML 標籤」比寫「不要輸出 thinking 標籤」有效。
  • 如果一定要關思考,給它一句台階:「你可以在使用工具前先講一句話。」這個失敗似乎來自你把它想講的開場話堵住了。
但最好的答案還是不要關。思考開著、把 effort 降到 lowmedium,成本大部分都省下來了,也不會踩到上面這些。
Part 06 · Fable 5

Fable 5 專屬:腳手架反而會害它

Fable 5 的心法性質不太一樣 —— 不是「哪句話該刪」,而是整個使用習慣要換

1. 一次請求可能跑好幾分鐘

這是最大的結構性轉變。高 effort 下,單一請求跑十幾分鐘是正常的。timeout、streaming、進度顯示、讓人「等等再回來看」的流程 —— 這些要事先規劃,不是等它掛了才補。

2. 舊模型的逐步 SOP 會讓它變差

官方講得很直接:為舊模型寫的提示詞與 skill 對 Fable 5 往往過度規定,反而降低輸出品質。遷移之後要 A/B 一次「把逐步指示拿掉」的版本。

# 舊模型時代:把步驟拆好餵給它 第一步先讀 A 檔。第二步比對 B 表。第三步列出差異。 第四步寫進 C。第五步回報。 # Fable 5:講目標與限制,讓它自己排 把 A 與 B 之間的差異找出來,寫進 C。 限制:不要動到 D,欄位命名沿用 B 的規則。

3. 給它一個記憶檔

只要有地方能把學到的東西寫下來(哪怕只是一個 .md),它的表現明顯更好。告訴它寫在哪、告訴它下次要先看那個檔、給它一個格式。

4. 給理由,不只給要求

它在知道「這件事是為誰做、輸出要拿去幹什麼」的時候表現更好 —— 比讓它自己猜意圖好得多。

我在做 X 這件事,要交給 Y。他們需要的是 Z。 在這個前提下:(你的要求)

5. 要求它把進度回報對照工具結果

長時間自己跑的工作,最怕它回報「做完了」但其實沒做。一句話就能處理,官方測試中幾乎消滅了捏造的進度回報

回報進度之前,每一項說法都要對照本次工作中實際的工具結果。 只回報你指得出證據的部分;還沒驗證的就明講還沒驗證。
不要把「剩餘 token 倒數」顯示給它看。很長的工作到後段,Fable 5 偶爾會擔心 context 不夠用,主動建議你開新對話、或自己把工作縮減。而觸發這件事最常見的原因,就是介面上出現了剩餘額度的數字。
速查

新舊對照速查表

如果你手上有一份用了一陣子的提示詞,照這張表翻一遍:

以前的做法 現在 為什麼
加一句「最後請再檢查一次」 刪掉 它本來就會自驗;催它會變成驗兩三次。官方明說移除後不會掉能力。
加一句「多用 subagent 平行處理」 拿掉,並且加上限 Opus 4.8 是不夠愛委派,Opus 5 反而太愛。成本是相乘的。
用 subagent 檢查它自己的成果 不要,在主流程裡驗 與第一條同源:多開一個人去檢查一個本來就會自檢的模型。
調低 effort 讓它少講話 改用提示詞要求簡潔 effort 影響的是思考量,不可靠地影響輸出長度。一句簡潔指令實測砍掉約 20%。
effort 反射性拉到最高 coding/agentic 從 xhigh、其他從 high,然後往下掃 lowmedium 在新模型上強得不合常理,往往還贏過舊模型的最高檔。
把舊模型的逐步 SOP 整套搬過來 A/B 一次「拿掉逐步指示」的版本 過度規定會降低 Fable 5 的輸出品質。講目標與限制就好。
關掉思考來省錢 思考開著,改用低 effort 省 關掉會出現「工具呼叫變純文字、那一輪卻回報成功」的靜默失敗。
加「不要思考」「不要推理」 刪掉 反而讓內部標籤更容易漏進回覆。
介面上顯示剩餘 token 倒數 不要顯示給模型看 會讓 Fable 5 在長工作後段主動建議開新對話或縮減工作。

互動實驗室:翻一下你的提示詞

點選一個你可能寫過的舊習慣,看它現在會造成什麼、以及該改成什麼:

載入中……

參考與引用來源 (References & Sources)

MORE

← 回知識分享總覽