Claude Opus 5 半價追 Fable 5:開發者要點計每項任務成本
Tech News

Claude Opus 5 半價追 Fable 5:開發者要點計每項任務成本

圖片:via Engadget — https://www.engadget.com/2222542/anthropic-says-opus-5-can-nearly-match-its-top-performing-model-for-half-the-price/
TechLab 編輯部(譯)·

同舊 Opus 同價,能力大升,但官方 benchmark 仲要等獨立驗證

Anthropic 推出 Claude Opus 5,定位幾清楚:畀日常要跑複雜 coding agent、文件分析同企業流程嗰批人,用 Opus 價錢攞接近 Fable 5 嘅能力。官方定價係每百萬 input token 5 美元、output token 25 美元,同 Opus 4.8 一樣;Fable 5 就係 10 美元同 50 美元。Claude Pro 入面,Opus 5 係最強模型;Claude Max 就預設用佢。

半價係 token 單價,唔代表每項工作平一半

Anthropic 講嘅「半價」,係 Opus 5 每 token 收費啱啱好得 Fable 5 一半。實際跑一項工作慳幾多,要睇模型生成幾多 token、call 幾多次工具、重試幾多輪,同埋有冇食到 prompt cache。長流程 agent 如果 Opus 5 要多走幾輪先完成,差價自然會縮;相反,佢若果真係可以用少啲步驟完成舊 Opus 4.8 搞唔掂嘅工作,每項任務成本先會明顯跌。

揀模型可以先咁分:大量簡單、互動速度行先嘅工作,Sonnet 5 仍然平好多;複雜 coding、code review、財務文件同長流程 agent,Opus 5 個價位較易放入正式產品;去到極長任務,或者幾個百分點準確率都值錢,先再考慮 Fable 5。三款都有 100 萬 token context window,Opus 5 同 Fable 5 嘅最高輸出都係 128,000 token,所以分野主要落喺能力、速度同帳單。

Anthropic 為 Claude Opus 5 製作嘅蛋形數字五主視覺

圖片:Anthropic

官方數字幾搶眼,但暫時只可以當官方數字睇

Anthropic 話 Opus 5 喺 Frontier-Bench v0.1 做到 43.3%,高過 Fable 5 嘅 33.7% 同 Opus 4.8 嘅 21.1%;CursorBench 3.2 開到 max effort 時,就同 Fable 5 最高分相差唔夠 0.5%。知識工作、電腦操作同自動化 benchmark 亦有類似升幅。不過呢批結果主要來自 Anthropic 同早期合作夥伴,測試用咩 effort、工具、token 預算同 agent harness,都足以改變排名。發佈首日仲未有足夠獨立測試,暫時未適合直接落結論話 Opus 5 全面追平 Fable 5。

Anthropic 官方比較 Opus 5、Fable 5、Opus 4.8 同其他模型嘅 benchmark 表

圖片:Anthropic

對 Claude Code,升級價值喺長流程穩定性

Opus 4.8 同 Opus 5 每 token 同價,所以原本已經用 Opus 跑 Claude Code 嘅團隊,升級門檻唔算高。官方同早期客戶集中講 root-cause analysis、自行驗證、改大型 codebase 同長時間維持方向,呢啲先係 coding agent 最易燒錢嘅地方:模型一早判斷錯方向,後面每次讀檔、跑測試同改 code 都繼續計 token。Opus 5 如果可以少啲兜路,價值會大過單次答題跑分;呢點亦最值得等獨立 coding 測試核對。

Effort 有用,但唔算全新概念

Engadget 提到新增 effort 選單,不過 API 嘅 effort 控制早已支援 Opus 4.8 等模型。Opus 5 仍然可以用 low、medium、high、xhigh 同 max 控制模型願意花幾多 token,API 同 Claude Code 預設係 high。簡單分類、查資料可以降到 low 或 medium;難改嘅 bug、跨檔案重構先推高。低 effort 通常亦會減少工具 call,所以除咗輸出少啲 token,工具成本亦有機會降低。不過每代模型嘅 effort 表現可以重新調校,正式轉模型前仍然要用自己嘅工作量重跑評估。

今次另一項 beta 更新其實係任務途中更改工具配置:開發者可以加減 Claude 可用嘅工具,同時保留前面嘅 prompt cache。呢樣對長流程 agent 幾實際,因為唔使為咗加入 browser、資料庫或者部署工具,重新付費處理整段對話。官方今次冇話途中轉用另一個模型都可保留同一份 cache,兩件事唔好撈亂;想分派平模型做簡單步驟,仍然要另外設計 routing 同計清 cache 成本。

香港直接使用仍然有一道閘

Anthropic 話 Opus 5 已喺所有平台推出,API model ID 係 claude-opus-5,亦列出 Amazon Bedrock、Google Cloud 同 Microsoft Foundry。不過截至 2026 年 7 月 24 日,Anthropic 官方嘅 Claude API 同 Claude.ai 支援地區名單都冇列出香港。換句話講,唔好見到「所有平台」就當香港註冊帳戶一定開到;經雲端供應商使用亦要逐邊核對帳戶資格、地區供應同額外收費。對已經有合資格 API 環境嘅團隊,Opus 5 就值得先用真實任務同 Opus 4.8、Sonnet 5 做成本對照,再決定有幾多流程要升級。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook