Claude Opus 5 同價升級:token 效率同 Claude Code 實際有咩改變
Tech News

Claude Opus 5 同價升級:token 效率同 Claude Code 實際有咩改變

圖片:via Ars Technica — https://arstechnica.com/ai/2026/07/anthropics-opus-5-is-about-token-efficiency-not-a-capability-leap/
TechLab 編輯部(譯)·

低 effort 值得試,Fast mode 同 migration 細節要先睇清

同價,但計法要睇每項任務

Anthropic 喺 7 月 24 日推出 Claude Opus 5,API 價維持每 100 萬 input token 5 美元、output token 25 美元,同 Opus 4.8 完全一樣。模型已經上架 Claude、Claude Code、Claude API 同主要雲端平台,亦成為 Max 計劃嘅預設模型。今次最值得開發者睇嘅位,係同一個模型可以用五級 effort 調校運算量,簡單工作少用 token,遇到大型重構或者長時間 agent 任務先推上 xhighmax

Anthropic 為 Claude Opus 5 製作嘅蛋形問號主視覺

圖片:Anthropic

Benchmark 有升,但官方數字要打折睇

Anthropic 話 Opus 5 喺 Frontier-Bench v0.1 嘅表現高過 Opus 4.8 一倍以上,每項任務成本仲要較低;CursorBench 3.2 開到 max effort 時,Opus 5 嘅分數只係低過 Fable 5 峰值 0.5%,但後者價錢貴一倍。不過呢批主要係官方同早期合作夥伴數據,Frontier-Bench 仲係 Anthropic 內部跑五次取平均,遇到安全分類器拒答時仲會轉交 Opus 4.8。發布首日獨立測試有限,暫時唔應該將跑分解讀成「能力高咗一倍」。Ars Technica 認為佢未見到 Opus 4.5 嗰種明顯躍升,呢個判斷合理,但仍然只係早期分析。

Claude Code 最實際係識得分配力氣

日常寫測試、解釋一段程式、處理範圍清楚嘅 bug,可以先試 lowmedium;跨多個檔案重構、反覆用工具同長時間 agent 任務,就由 xhigh 起步。官方話 Opus 5 用低、中 effort 都勁過舊 Opus;如果自己項目試出嚟都有同樣效果,同一段 Claude Code 用量就可以做多啲工作。模型亦會主動驗證結果、較常交工作畀 subagent,舊 prompt 入面嗰啲「最後再檢查一次」指示反而可能令佢重複驗證。任務範圍同輸出長度最好寫清楚,否則慳咗 thinking token,畫面上嘅回覆仍然可以好長。

每 token 同價,張單未必一樣

Output token 單價係 input 嘅五倍,所以 agent 行幾多輪、叫幾多次工具同諗幾耐,對總成本影響大過型號表面價錢。Opus 5 喺 API 同 Claude Code 預設用 high effort,直接換 model ID 未必即刻慳錢;低 effort 亦只係行為提示,唔係硬性 token 上限。Anthropic 引述一間法律科技客戶,話相近表現下平均少用 26% token,但呢個只屬單一合作夥伴測試。API 團隊應該用自己嘅 bug、code review 同重構任務重跑 eval;訂閱用戶亦要分清用量上限同 API 逐 token 收費,兩套數唔可以混埋計。

100 萬 token context 唔等於免費塞資料

Opus 5 預設同上限都係 100 萬 token context,最長輸出 128,000 token,而且冇長 context 附加費。照標準 API 價計,單次塞滿 100 萬個未快取 input token 已經係 5 美元,仲未計輸出,所以呢個容量適合用嚟減少切割大型程式庫、文件同工具定義,唔代表應該每次全部倒入去。好消息係 prompt cache 最低門檻由 Opus 4.8 嘅 1,024 token 降到 512 token,cache hit 每 100 萬 token 收 0.50 美元;重複使用固定規則同工具定義嘅 agent,呢項改動嘅慳錢效果可能仲實際過加大 context。

Fast mode 用錢換等待時間

Fast mode 官方標示大約快過標準模式 2.5 倍,API 價亦剛好翻倍至每 100 萬 input token 10 美元、output token 50 美元。佢暫時屬 research preview,只限 Anthropic 自家 API,Bedrock、Google Cloud 同 Microsoft Foundry 都未有;Claude Code 就可以經 usage credits 使用。趕住互動除錯、處理事故或者等 agent 完成關鍵步驟時,快兩倍幾可能值回票價;大量離線任務或者 nightly job 就難啲合理化。速度模式唔會提高模型能力,成本評估仍然要連 effort 同實際 token 數一齊睇。

Migration 唔止換一行 model ID

由 Opus 4.8 升級,model ID 改成 claude-opus-5,但原本冇設定 thinking 嘅 request 會自動開 adaptive thinking,而 max_tokens 同時限制 thinking 加可見輸出。若果將 thinking 關閉再配 xhighmax,API 會直接回 400 error;Opus 4.8 原先接受呢個組合。Opus 5 暫時亦唔支援 web fetch 同 Priority Tier,預設回覆較長,安全分類器拒答嘅處理亦要重新檢查。用開 4.8 嘅團隊值得小流量試升,先比較每項任務成功率、總 token、工具調用次數同延遲,再決定邊類工作長期轉過去。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook