Claude 四個模型一次就選對——什麼活配什麼模型,還有一句話就能調度它們的方法
用 Claude 一直改一直改,就是改不到你要的結果?
很多時候不是你不會問,是模型選錯了。
同一個問題丟給不同的模型,拿回來的東西差很多。輕的模型接了重活,你會發現改了五次還是不對,最後還是自己下海收尾;反過來,一句話就能做完的小事開了最強的那個,額度唰一下就噴掉一大截。兩種都很浪費,只是浪費的東西不一樣——一個燒你的時間,一個燒你的 token。
選對了,同一件事做起來會突然變得很順。
尤其 Opus 5 出來之後,選單裡一口氣四個模型:Haiku、Sonnet、Opus、Fable。看起來只是大小不同,實際上分工完全不一樣,成本還差到十倍。到底要怎麼選?
這篇把「什麼活配什麼模型」講清楚。(想再省一點的,文末附錄有一招:叫它派便宜的模型去跑雜活。)
一、先看清楚:四個模型分別是誰
Anthropic 官網對這四個的形容其實很短,我把原文和白話並排放,你就懂它們的分工了:
| 模型 | 官方原文 | 白話 | 成本 | 速度 | 知識截止 |
|---|---|---|---|---|---|
| Haiku 4.5 | fast and lightweight | 工讀生 | 1 | 最快 | 2025 / 2 |
| Sonnet 5 | the daily driver | 日常主力 | 3 | 快 | 2026 / 1 |
| Opus 5 | a large reasoning specialist | 深度推理專家 | 5 | 中等 | 2026 / 5 |
| Fable 5 | 最大、最重要的專案 | 大魔王 | 10 | 較慢 | 2026 / 1 |
「成本」那欄是官方牌價的比例,換算自每百萬 token 的定價:
- Haiku 4.5 — $1 輸入 / $5 輸出
- Sonnet 5 — $3 / $15(介紹價 $2 / $10,到 2026 年 8 月 31 日)
- Opus 5 — $5 / $25
- Fable 5 — $10 / $50
輸入和輸出剛好是同一組比例,所以可以直接記成 1 : 3 : 5 : 10。同一份工作丟進去,一個花 1 塊,一個花 10 塊。
有兩個欄位值得多看一眼:
知識截止那欄,最新的反而是 Opus 5(2026 年 5 月),比最貴的 Fable 5 還新四個月。問時事、問最近的版本變化,Opus 5 反而比較不會給你舊資訊。
Haiku 的知識停在 2025 年 2 月,而且它的脈絡長度是 20 萬 token,其他三個都是 100 萬。所以 Haiku 適合「當下這一段」的工作,不適合丟一整本資料進去。
二、一句話選法
這是我自己貼在桌邊的版本:
| 你的狀況 | 選 |
|---|---|
| 一句話能答完的 | Haiku |
| 大部分工作、不確定選哪個 | Sonnet 5 |
| 難的、長的、要來回改的 | Opus 5 |
| 最大最重要、想讓它自己跑完 | Fable 5 |
展開講,各自適合的任務長這樣:
Haiku——工讀生
判準:一句話能答完、不用它想的。
這個別自己猜,官方寫得很清楚。Anthropic 自己列的 Haiku 用途只有五條,我翻成白話:
一句話就能答完的問題/只是查一下或分類/從一段文字裡把某個資訊挑出來/簡單的摘要/任何你希望「立刻拿到、不需要它想」的事
對到日常就是這些:
- 這句話幫我翻成英文
- 這封信是詢價還是廣告?(分類)
- 這段落落長的訊息,兩句話講完(摘要)
- 從這封信裡把日期、地點、金額挑出來(擷取)
- 這句話幫我改順一點,有沒有錯字
- 這些日期改成同一種寫法、這串金額台幣換美金(換算、改格式)
- 這個名詞是什麼意思,一句話解釋
重點是那個「不需要它想」——只要你心裡已經知道答案長什麼樣,只是懶得自己動手,就是 Haiku。
還有一句官方寫了、但很少人注意的:
It’s also the most efficient with your rate limit. (它也是最省你額度的那個)
所以上面這種一句話等級的事,一律先丟 Haiku——不只是省錢,是讓你的額度撐到下班。
注意兩件事:Haiku 的知識停在 2025 年 2 月,別問它時事;脈絡長度只有 20 萬(其他三個都是 100 萬),別丟一整本資料給它。
Sonnet 5——日常主力
判準:有明確的做法,只是量大或步驟多。
- 寫一篇部落格文章、改一版銷售文案
- 一小時的會議逐字稿 → 整理成重點加待辦
- 讀一份 Excel,做出分析摘要和圖表
- 寫一支自動改檔名、自動寄信的小程式
- 一篇長文改寫成 IG 貼文、FB 貼文、口播腳本
- 幫一篇文章想十個標題選項讓你挑
- 幫你排課程大綱、活動流程、客戶回覆範本
官方自己叫它 the daily driver,我覺得很傳神——不確定要選哪個的時候選它就對了,它是那個不會出錯的預設值。
Opus 5——深度推理專家
判準:你自己做這件事需要「想一下」,而不是「知道就能做」。
- 「我這個服務該定多少錢」這種要權衡的判斷
- 一個跑很久的流程,請它從頭拆解、找出到底卡在哪
- 要跨十幾個檔案一起改的功能
- 你會一直追問、改方向、來回三四輪的工作
- 從零設計一套做法(不是照著做,是先幫你想出來)
- 讀完一堆資料後幫你下判斷,而不是只做摘要
- 那種你自己也還沒想清楚、需要邊做邊釐清的事
Fable 5——大魔王
判準:你想描述完就走開,回來看成果。
- 一次交代完一個大專案,讓它自己跑到底
- 不能出錯的東西(要交給客戶、要對外公開的)
- 長時間、多步驟,中途你不想一直盯著的
它的特色是能更自主地跑完長流程,中途需要你確認的次數比較少。
三、但其實,要看你的使用量
上面講了一堆判準,這裡要誠實補一句。
如果你一天只問個兩三次,全部用最高規的也沒差,額度根本用不完。 這一段對你來說就是「知道一下」,不用真的每次去挑。
真正需要選對的,是這兩種情況:
一、你的額度常常爆掉。 一到週末就沒得用、或是做到一半被擋下來——那多半不是你用太多,是簡單的事一直開最貴的那個。光把雜事換成 Haiku,感受就會差很多。
二、你想把越來越多事情交給它自動跑。 量一上來,1 : 3 : 5 : 10 的差距會直接反映在你的額度和帳單上。一天跑三次沒感覺,一天跑三百次就有感了。
換句話說:先看你的量,再決定要不要精算。 量不大就放心用最好的;量開始上來,再回頭把雜事往便宜的模型分出去(做法放在文末附錄)。
四、Opus 5 值不值得換:我的實測
老實說,Opus 5 剛出的時候我一點都不期待。
強沒有 Fable 5 強,省沒有 Sonnet 5 省,卡在中間——當下真的有點不知道它是來幹嘛的。
結果實測完,它變成我最愛的那個。原因有五個:
一、一半的價錢。 在寫程式的評測上(官方公布的 CursorBench 3.2),Opus 5 只差最貴的 Fable 5 0.5 分,價錢卻只有一半。
二、額度幾乎不會爆。 這條是我的實際使用感受,不是官方數字——我可以一直用,不用像以前用 Fable 那樣小心翼翼。(訂閱制各模型的額度換算,官方沒有公布,所以我只能講體感。)
三、它會自己回頭檢查。 這條官方講得很直白:Opus 5 會在沒被要求的情況下驗證自己的工作,所以官方甚至建議開發者把「請再檢查一次」這類指令從提示裡刪掉,不然它會過度檢查。
四、跑的時候可以插話。 你在 Claude Code 打字送出,訊息會排隊,它這一輪跑完就接著讀;想單獨問一句不打斷主線的話,用 /btw 側問題,而且因為共用同一份提示快取,額外成本很小。真要轉彎按 Esc,已經做完的工作不會作廢。
五、資料最新的反而是它。 前面那張表提過了——2026 年 5 月,比 Fable 5 還新四個月。
一句話總結:它不再只是「執行」,而是會先想過、執行、還幫你檢查。
最後
四個模型不是「好壞排序」,是四種不同的同事。
不是永遠選最貴的,是選對的——知道誰配什麼活,你會發現同樣的時間,事情做得比以前多。
附錄:想再省一點,可以叫它派便宜的模型去跑雜活
這段是給已經在用 Claude Code、想再壓一點成本的人看的。沒用到也完全不影響前面的內容。
同一個對話裡,你可以把其中幾個步驟外包給便宜的模型去跑,這在 Claude Code 裡叫 subagent。官方文件介紹它的好處時,第一條就是「把任務路由到更快、更便宜的模型來控制成本」。
三種做法,由淺到深:
一、直接講。 不用任何設定,對話裡講一句就好:
這個專案裡處理付款的檔案在哪?開一個 Haiku 的 subagent 去找,回報給我就行
二、寫進記憶,就不用每次講。 跟 Claude 說「把這條加到 CLAUDE.md」,它會寫進那個每次開新對話都自動讀的檔案:
找檔案、搜尋、跑測試這類跑腿的工作,開 subagent 用便宜一階的模型去跑。
三、找現成的 skill 或 plugin 裝來用。 別人已經把「這個工作分幾步、哪一步該用哪個模型」整包寫好了,裝起來直接跑。
重點不是一律用 Haiku,是往下降一階——主對話開 Fable,執行丟給 Opus 就已經打對折。
最後老實說一句:這套要玩得順,前提是你對「一件事會拆成哪些步驟、哪一步該用哪個模型」有感覺,而那個感覺是做出來的,不是看文章看來的。還沒有的話,先從第一種做法開始,或直接裝別人寫好的來看它是怎麼分的。
出處
本文數字皆對官方頁面查證(2026-07-25):
- 四模型定價、速度、知識截止與脈絡長度 — Claude 模型總覽
- Haiku/Sonnet/Opus/Fable 的官方形容、Haiku 的五條官方用途與「最省額度」 — Choosing the right Claude model
- Opus 5 發布、CursorBench 3.2 差距與定價 — Claude Opus 5 發布公告
- Opus 5 會自我驗證、建議刪除驗證指令 — What’s new in Claude Opus 5
- subagent 的每次呼叫可指定模型、以及「用便宜模型控制成本」 — Create custom subagents
- CLAUDE.md 的位置、每次對話自動載入、
/memory,以及「context, not enforced configuration」 — How Claude remembers your project - 訊息排隊與
/btw側問題 — Claude Code 互動模式