Claude Opus 5 半價講法要睇清:coding agent 慳幾多要計 effort
Tech News

Claude Opus 5 半價講法要睇清:coding agent 慳幾多要計 effort

圖片:via TechNews 科技新報 — https://technews.tw/2026/07/26/anthropic-debuts-opus-5-at-half-the-price-of-its-fable-sibling/
TechLab 編輯部(譯)·

定價照跟 Opus 4.8,Fast mode 同 fallback 都會改變實際帳單

Anthropic 推出 Claude Opus 5,TechNews 科技新報形容佢係企業 AI「成本救星」。個講法幾搶眼,不過要先睇清楚比較基準:Opus 5 每百萬 input token 收 US$5、output token 收 US$25,同 Opus 4.8 完全一樣;所謂半價,係攞每百萬 token 收 US$10/US$50 嘅 Fable 5做對照。用開上一代 Opus 嘅 API 客戶,單價冇突然平咗一截。

Coding agent 先食到最大著數

Opus 5 最吸引嘅地方,係 Claude Code、IDE agent 同自動改 code 呢類長時間任務。Anthropic 公布嘅 Frontier-Bench v0.1 結果顯示,Opus 5 得分 43.3%,高過 Fable 5 嘅 33.7% 同 Opus 4.8 嘅 21.1%;CursorBench 3.2 用 max effort 時,官方話佢同 Fable 5 最高成績只差 0.5%,每次任務成本就約平一半。對成日要 agent 讀大型 codebase、反覆改檔同跑測試嘅團隊,呢個價差有實際份量。

不過,呢批數字主要來自 Anthropic 或合作平台嘅指定測試,TechLab 暫時冇實測。Frontier-Bench 嗰次官方內部測試用 mini-SWE-agent harness、GKE backend,每題跑五次再計平均;遇到安全分類器拒絕時,Opus 5 同 Fable 5 都會轉交 Opus 4.8。換句話講,圖表量度咗一套指定 agent 配置連 routing 嘅結果,直接套落一般 Claude Code session,未必會有同一個成功率或者帳單。

Anthropic 為 Claude Opus 5 製作嘅官方主視覺,以蛋形圖案砌成數字 5

圖片:Anthropic

Effort 高低影響埋單價,多過模型名

Opus 5 提供 low、medium、high、xhigh 同 max effort。較低設定會少用推理 token、回得快啲,官方圖表亦顯示佢喺部分 coding 任務仍可保留唔錯表現;升到 max 就會用多啲運算同 token,換取較高成功率。API 用戶應該按任務分流:格式整理、小修改同簡單查錯先用低 effort,跨檔案重構或難解 bug 再升級。全部請求長開 max,US$5/US$25 呢組單價都救唔到反覆重試同冗長輸出帶嚟嘅成本。

呢度亦解釋咗點解「每 token 半價」唔等於「每個任務半價」。一個醒目啲嘅模型如果少做幾輪、少叫幾次工具就做啱,總成本可以低好多;相反,模型平一半但連續改錯、重讀 context 同重跑測試,最後一樣可能貴。Anthropic 暫時未有公開足夠真實企業帳單,證明 Opus 5 普遍幫公司慳到一半,所以而家較穩陣嘅做法,係拎自己嘅 issue、repo 同成功條件做 A/B 測試。

Claude Opus 5、Fable 5、Opus 4.8 同 GPT-5.6 Sol 多項 benchmark 成績表

圖片:Anthropic

Fast mode 用速度換走半價優勢

Opus 5 嘅 Fast mode 約快過預設速度 2.5 倍,Claude Platform 按基本價兩倍收費,Claude Code 就經 usage credits 提供。計返 API 單價即係約 US$10 input、US$50 output,數字上已經去到 Fable 5 標準速度嘅價位。趕住等 agent 回覆、工程師時間比 token 貴嗰陣,Fast mode可能抵用;背景自動化、夜晚批次任務或者冇人等結果嘅工作,長開快速模式就幾難講得上慳錢。

Frontier-Bench 圖表比較各模型喺唔同 effort 設定下嘅 coding 得分同每次嘗試成本

圖片:Anthropic

Safety fallback 令任務繼續,但輸出會轉模型

Opus 5 對部分滲透測試、binary 漏洞掃描同 exploit 生成設有分類器。Anthropic 話,呢套分類器介入次數估計少過 Fable 5 約 85%;Claude、Claude Code 同 Claude Cowork 遇到指定拒絕時,預設可轉去 Opus 4.8。Claude API 亦加入 beta fallback,開發者可用官方建議路線或自行指定最多三個後備模型,回應會標明最後由邊個模型處理。

呢個設計可以減少 agent 半途停低,但做 code review、資安掃描或者受規管自動化嘅團隊要記錄模型切換。後備模型嘅能力、輸出風格同驗證結果可能唔同,而且 fallback 只處理安全分類器拒絕,rate limit、server overload 同其他錯誤照樣要自己接住。對多數 Claude Code 用戶,Opus 5睇落會係較合理嘅日常高階選擇;Fable 5值唔值兩倍 token 價,就留返畀真係跑超長任務、而且已用自家數據證明佢少錯好多嘅團隊。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook