Anthropic 在 2026 年 7 月 24 日發表 Claude Opus 5,官方宣稱它在多項 benchmark 上勝過自家更強、但安全限制也更多的 Fable 5,並且定價維持每百萬 token 輸入 5 美元、輸出 25 美元,與 Opus 4.8 完全相同。同一張官方定價表上,Fable 5 是輸入 10 美元、輸出 50 美元——Opus 5 剛好是旗艦的一半。
我要下的判斷是:這次發布真正的重點不是誰跑分高,是「同一個價格帶換到更高的能力」對成本結構的影響。 對台灣的獨立開發者、小型軟體團隊和一人公司,這件事比任何一項排行榜名次都實際:你原本算過一輪、覺得「這個自動化流程跑起來不划算」而放棄的題目,現在值得重算一次。
先把查證到的事實與分寸擺清楚
- 時間點很密:距離 Opus 4.8 在 5 月 28 日發表只有約兩個月,同一個價格帶在兩個月內換了一次體質。
- 通路與規格:Opus 5 是 Claude Max 的新預設模型、Claude Pro 上可用的最強模型,API 代號
claude-opus-5,脈絡窗 100 萬 token(同時是預設與上限)、單次輸出上限 12.8 萬 token。 - 官方宣稱的能力:Anthropic 宣稱 Opus 5 在 Frontier-Bench 與 GDPval-AA 上是新的最高水準,在 CursorBench 3.2 上「與 Fable 5 最佳分數相差不到 0.5%、成本只要一半」,在 OSWorld 2.0 上「以約三分之一的成本超過 Fable 5 的最佳結果」。這些全是官方宣稱、尚未經第三方廣泛獨立驗證,一律打折看。 官方也說明它在資安任務上仍落後 Mythos 5,漏洞利用開發這塊差距明顯。
「同價位、更高能力」為什麼是結構性變化
外電多半停在「便宜一半」這句話,不會替台灣的小團隊往下算一層。往下算,變化在三個地方。
第一,agent 流程的單位成本直接下修。 agent 貴不在單次呼叫,而在它會反覆呼叫工具、反覆修正。官方文件有一個點得開的試算:用 Opus 5 跑一小時的 coding 工作階段、消耗 5 萬輸入與 1.5 萬輸出 token,加上工作階段執行費約 0.705 美元;若其中 4 萬輸入 token 命中提示詞快取,降到約 0.525 美元。這個量級,才是「一人公司養不養得起一條自動化流程」的真實刻度。
第二,省錢的旋鈕變多了。 Opus 5 的批次處理是輸入 2.5 美元、輸出 12.5 美元(五折),快取命中只要 0.5 美元;可快取的最短提示詞長度也從 Opus 4.8 的 1,024 token 降到 512 token——這對提示詞不長、呼叫次數多的小型服務特別有感,以前太短進不了快取的請求,現在進得去。它還支援 low 到 max 五段 effort 設定,預設 high,官方宣稱 low 與 medium 能用少得多的 token 維持不錯品質。把旋鈕轉對,比追新版本號有用。
第三,這不是 Anthropic 一家的動作,是 2026 下半年的主戰場。 Google 一口氣推三款 Gemini 並調降輸出價、資本押注小而特化的模型比一路呼叫前沿大模型划算、開源陣營的 Kimi K3 把「逼近前沿又便宜」推到新高度——都指向同一條曲線:現在比的不是誰最聰明,是誰讓你「完成一件事」最便宜。
但三件事,我不建議忽略
第一,跑分是宣稱,你要測的是「每完成一件正確任務多少錢」。 廠商的 benchmark 用它挑的題目,你的專案不是。而且 Opus 5 有個容易被忽略的行為變更:官方明說它的 thinking 預設開啟,這是相對 Opus 4.8 的破壞性變更,而 max_tokens 是「思考加回答」的總上限——直接改個模型代號就上線,很可能遇到輸出被截斷或帳單超出預期。官方也提醒把舊模型時代「最後請再驗證一次」這類指令拿掉,否則會過度驗證、反而燒更多 token。
第二,Automatic Fallbacks 對生產環境是雙面刃。 這是隨 Opus 5 推出的 beta 功能:請求被安全分類器攔下時,可選擇自動改由另一個模型回答,而不是回傳錯誤。方便當然方便,但反過來說,你的關鍵流程可能在不知情下被一個較弱的模型回答了。 好消息是它可偵測:官方 cookbook 說明回應會插入 fallback 內容區塊、並在 usage.iterations 記錄每一段由哪個模型服務;Claude 應用端則是第一次選用 Opus 5 時預設開啟,切換會顯示提示、回應會標示實際回答的模型,也能在設定裡關掉。建議很直接:做給客戶用的流程,一定要把 fallback 事件記進自己的日誌,不然出事那天你查不出品質為什麼忽然掉下來。(Anthropic 預期分類器在 Opus 5 上觸發頻率比 Fable 5 低約 85%,這也是官方預期值。)
第三,資料保留政策的差異,是台灣 B 端的實際採購決策點。 官方發布頁載明 Opus 5 在一般存取下沒有資料保留要求;相對地 Fable 5 這類模型為了運作安全分類器,據 GitHub 官方變更日誌,提示與輸出會被保留最多 30 天(期滿刪除、不用於訓練,其他 Claude 模型仍在零資料保留下運作)。對受監理的金融、醫療或簽了保密協議的外包專案,這條的重要性不亞於價格——你可能因為合規根本不能用最強那一顆,這時「次強但沒有保留要求、又只要一半價」反而是唯一過得了關的選項。 這跟我之前寫的誰決定你用不用得到最強 AI 是同一主題的另一面:能力不是唯一的門檻,政策也是。
一套 awareness 級的換模框架
先別急著把所有專案的模型代號改掉。用這四個問題判斷:
- 這是不是「以前算過但放棄」的那一批? 當初放棄的原因若是成本,它就最該重算。若當初是因為「模型根本做不對」而放棄,價格減半救不了你,該重測的是能力不是帳單。
- 你能不能自動判斷對錯? 換之前先準備 20 到 50 題自己的真實任務、附上正確答案跑一輪對照。看的指標是「每完成一件正確任務多少錢」,不是「每百萬 token 多少錢」。
- effort 掃過了嗎? 官方建議從預設的
high出發、依自己的評測往上或往下調,別把舊模型的設定直接沿用。多數團隊真正的省錢空間在這裡,不在換供應商。 - 合規那一關問清楚了嗎? 資料會被保留幾天、能不能走零資料保留、fallback 換到的模型是否適用同一份政策——這三題要在導入前問,不是出事後問。更完整的選型與成本控管思路,我整理在企業 AI 工具選型與 AI 成本優化,Claude 本身怎麼用放在 Claude 使用指南。
一句話的判斷
Opus 5 值得台灣的小團隊認真看,但看的角度要對:它不是「又一個更強的模型」,而是「你原本的預算現在買得到更多能力」。價值不在跑分表上,在你那張被成本卡住的待辦清單上。該重算的流程重算一遍、effort 與快取兩個旋鈕轉對、fallback 記進日誌、資料保留問清楚——這四件事做完,紅利會比追任何一次版本號更新都多。至於它是不是真的逼近旗艦,那是 Anthropic 的宣稱;只有你自己任務跑出來的數字才是答案。
常見問題
Claude Opus 5 多少錢?比 Fable 5 便宜多少?
依 Anthropic 官方定價頁,Opus 5 是每百萬 token 輸入 5 美元、輸出 25 美元,與 Opus 4.8 相同;Fable 5 則是輸入 10 美元、輸出 50 美元,所以 Opus 5 剛好是旗艦的一半價。另外批次處理有五折(輸入 2.5 美元、輸出 12.5 美元),提示詞快取命中只要 0.5 美元。要注意還有研究預覽階段的高速模式,價格是基本價的兩倍。
Opus 5 真的比 Fable 5 強嗎?
不能這樣說死。Anthropic 官方宣稱 Opus 5 在多項 benchmark 上勝過 Fable 5,並在 Frontier-Bench、GDPval-AA 上是新的最高水準,但這些是官方宣稱、尚未經第三方廣泛獨立驗證。官方自己也說明 Opus 5 在資安任務上仍落後 Mythos 5,且對最複雜、長時間自主執行的專案仍建議用 Fable 5。想知道對你有沒有用,拿你自己的任務去測。
Automatic Fallbacks 是什麼?會不會讓我在不知情下被較弱的模型回答?
這是隨 Opus 5 推出的 beta 功能:請求被安全分類器攔下時,可以選擇自動改由另一個模型回答,而不是回傳錯誤。確實有「被較弱模型回答」的風險,但它可以偵測——官方 cookbook 說明回應會插入 fallback 內容區塊,並在 usage.iterations 記錄每一段由哪個模型服務。生產環境的建議是把 fallback 事件記進自己的日誌並設告警;Claude 應用端則會顯示切換提示,也可以在設定裡關掉。
Opus 5 和 Fable 5 的資料保留政策差在哪?對台灣企業有影響嗎?
有,而且是實際的採購決策點。Anthropic 官方發布頁載明 Opus 5 在一般存取下沒有資料保留要求;Fable 5 這類模型為了運作安全分類器,據 GitHub 官方變更日誌,提示與輸出會被保留最多 30 天(期滿刪除、不用於訓練)。對受監理的金融、醫療或簽了保密協議的外包專案,這一條可能比價格更關鍵——導入前就該問清楚保留天數與是否支援零資料保留。
我可以直接把專案的模型代號從 Opus 4.8 換成 Opus 5 嗎?
不建議直接換上線。官方明確列出兩個行為變更:Opus 5 的 thinking 預設開啟(Opus 4.8 預設不開),而 max_tokens 是思考加回答的總上限,所以要重新檢視;另外在 xhigh 或 max effort 下關閉 thinking 會回傳 400 錯誤。官方也提醒把舊模型時代「最後請再驗證一次」這類指令移除,否則會過度驗證、多燒 token。先在測試環境跑一輪自己的評測題再說。
參考來源
- Anthropic 官方:Introducing Claude Opus 5(發表日、能力宣稱、Claude Max 預設/Claude Pro 最強模型、Automatic Fallbacks beta、資料保留說明)
- Anthropic 官方文件:What’s new in Claude Opus 5(定價 5/25 美元、100 萬 token 脈絡窗、12.8 萬輸出上限、thinking 預設開啟等破壞性變更、快取最低長度降至 512 token、上架平台)
- Anthropic 官方定價頁(Opus 5 與 Fable 5 對照、批次五折、快取價、高速模式、一小時工作階段成本試算)
- Anthropic 官方文件:Effort(五段 effort 級別、Opus 5 預設為 high 與建議調法)
- Anthropic 官方 cookbook:Classifier fallback and billing(fallback 內容區塊、usage.iterations 偵測方式、beta 標頭與計費處理)
- Claude 支援文件:Why Claude switched models in your conversation with Opus 5(應用端預設開啟、會顯示提示與回答模型標示、可於設定關閉)
- TechCrunch:Anthropic launches Opus 5(Opus 4.8 為 5 月 28 日發表、分類器觸發頻率預期低約 85%、Automatic Fallbacks 定位)
- GitHub Changelog:Claude Fable 5 is generally available for GitHub Copilot(Fable 5 保留提示與輸出最多 30 天、其他 Claude 模型維持零資料保留)