Claude Opus 5 半價追近 Fable 5:Claude Code 用家值得即轉?
3C 產品

Claude Opus 5 半價追近 Fable 5:Claude Code 用家值得即轉?

圖片:via Android Authority — https://www.androidauthority.com/anthropic-launches-claude-opus-5-3691255/
TechLab 編輯部(譯)·

API 同上代同價,官方跑分勁升,但首日獨立實測仍然有限

Anthropic 喺 7 月 24 日推出 Claude Opus 5,定位幾進取:能力貼近旗艦 Fable 5,價錢只收一半,仲直接取代 Opus 4.8 做 Claude Max 預設模型,亦係 Claude Pro 而家最強選擇。對 Claude Code 用家同用 API 跑 agent 嘅團隊,呢次更新幾實際,因為唔使加 token 單價,就有機會減少重試、工具呼叫同埋執手尾時間

Opus 5、Fable 5 同 Opus 4.8 點計錢

Opus 5 標準 API 收費係每百萬輸入 token US$5、輸出 token US$25,同 Opus 4.8 完全一樣;Fable 5 就分別收 US$10 同 US$50。Anthropic 亦提供約快 2.5 倍嘅 Fast mode,收費升至 US$10/US$50,即係去返 Fable 5 標準價。Claude Code 訂閱用家就經 usage credits 使用 Fast mode,所以「快」幾多同「燒 quota」幾快,要按自己嗰類工作實際計數,唔可以當免費加速。

真正影響成本嘅仲有 effort 設定。Opus 5 可以用 low、medium、high、xhigh 同 max 控制推理量;簡單改名、整理文件或者細型修補,未必值得長開 max。複雜除錯、跨檔案重構同長時間 agent 工作先逐級加上去,通常慳得多過死揀平價模型。換句話講,模型路由同 effort 配置會直接左右每個完成任務嘅成本,單睇每百萬 token 個價只係計到一半。

Anthropic 官方表格比較 Opus 5、Fable 5、Opus 4.8 同 GPT-5.6 Sol 多項跑分

圖片:Anthropic

Coding 跑分升幅大,但數字主要來自官方

Anthropic 公布嘅 Frontier-Bench v0.1 結果入面,Opus 5 得分 43.3%,高過 Fable 5 嘅 33.7% 同 Opus 4.8 嘅 21.1%;喺 CursorBench 3.2 開到最高 effort,官方話佢同 Fable 5 峰值只差 0.5 個百分點,每項工作成本就平一半。呢批結果確實幾搶眼,不過測試環境、agent harness、effort 同安全 fallback 都由 Anthropic 設定,而家只可以當係產品能力上限嘅參考,未足以代表你個 repo 都會快一倍。

Fable 5 亦未完全冇優勢。官方表格入面,佢喺 DeepSWE v1.1 以 69.7% 輕微領先 Opus 5 嘅 68.8%,FrontierCode 1.1 同法律 agent 測試亦高少少。呢類差距細到可能受測試波動影響,不過至少反映 Fable 5 仲適合最難、最長、失敗成本高嘅工作。日常寫功能、查 bug、review PR 同知識工作,Opus 5 個價錢就合理得多。

Anthropic 官方 Frontier-Bench 圖表,顯示各模型喺唔同 effort 同成本下嘅 coding agent 得分

圖片:Anthropic

獨立數據確認夠強,速度就未算突出

第三方 Artificial Analysis 用新版 Intelligence Index 測試,Opus 5 xhigh 同 Fable 5 max 同樣有 60 分,Opus 4.8 max 就有 56 分。支持「接近 Fable」呢個講法。成本亦有明顯分別:跑完整套測試,Opus 5 約花 US$2,910,Fable 5 約 US$5,631,Opus 4.8 約 US$3,753。不過設定唔完全相同,加上呢套係綜合推理測試,唔可以直接當成 Claude Code 完工率。

速度方面仲要睇清楚。Artificial Analysis 經 Anthropic API 量到 Opus 5 約每秒輸出 50.7 token,慢過 Fable 5 約 73.5 token,亦慢過 Opus 4.8 約 59.8 token;等到第一個答案 token,平均要約 43.85 秒。Opus 5 全套測試用嘅輸出 token 少過上代,所以完成整項工作仍可能快啲同平啲,但如果你最介意畫面逐字輸出速度,普通模式暫時唔算爽,Fast mode 又要畀雙倍價。

Anthropic 官方 CursorBench 圖表,比較 Opus 5、Fable 5 同 Opus 4.8 每項工作成本及得分

圖片:Anthropic

Claude Code 同 API 用家應唔應該轉

Claude Code 訂閱用家如果本身用 Opus 4.8,有得揀 Opus 5 就值得先轉一兩個真實項目試,尤其係大型改動、除錯、前端視覺修正同要模型自己驗證結果嘅工作。Fable 5 可以留畀極長任務或者 Opus 5 連續做唔掂嘅 case,冇必要每次都先燒最貴模型。Pro、Max、Team 同 Enterprise 嘅實際用量限制各有分別,轉完最好望住一星期 quota 消耗,先決定預設 effort。

API 團隊就唔好淨係改 model ID 後直接上 production。Anthropic 文件寫明 Opus 5 會預設開 adaptive thinking,舊有 max_tokens 設定可能截斷答案;以前 prompt 入面重複叫模型自我檢查,亦可能令佢過度驗證同浪費 token。較穩陣做法係抽一批真實任務,比較成功率、總 token、完成時間同人工修正量。以而家資料睇,Opus 5 好大機會取代 Opus 4.8 做日常主力,Fable 5 就留喺少數高難度工作;再等多幾輪獨立 coding agent 測試,先判斷兩者條界應該畫喺邊。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook