Claude Opus 5 半價追貼 Fable 5:coding agent 點揀先抵
3C 產品

Claude Opus 5 半價追貼 Fable 5:coding agent 點揀先抵

圖片:via 9to5Google — https://9to5google.com/2026/07/24/anthropic-launches-claude-opus-5/
TechLab 編輯部(譯)·

三款 Claude 5 價錢、速度、能力同平台支援一次拆清

Anthropic 推出 Claude Opus 5,開價同上一代 Opus 4.8 一樣,每百萬 input token 5 美元、output token 25 美元,啱啱係 Fable 5 嘅一半。官方形容佢有接近 Fable 5 嘅能力,主攻 coding agent、企業自動化同專業工作。呢次更新幾實際:公司未必再要為每個複雜 job 都開最貴嗰款模型,不過「半價」只係 token 牌價,唔代表最後每張 agent 工作單都會自動平一半。

三款 Claude 5 點分工

模型 每百萬 input/output token 速度定位 較啱咩工作
Fable 5 US$10/US$50 較慢 最長、最複雜嘅自主 agent、科研同高難度 coding
Opus 5 US$5/US$25 中等 複雜 coding、debug、code review、企業流程同分析
Sonnet 5 US$3/US$15 大量日常 coding、工具調用、客服同成本敏感自動化

Sonnet 5 去到 2026 年 8 月 31 日仲有 US$2/US$10 推廣價,純睇流量成本依然平過 Opus 5。三款都有 100 萬 token context window 同 128,000 token 輸出上限。Opus 5 另有 Fast mode,Anthropic 話速度約係預設模式 2.5 倍,不過 API 價亦係基本價兩倍,即每百萬 input/output token US$10/US$50,價位直接返到 Fable 5 水平。

Anthropic 發布 Claude Opus 5 嘅官方主視覺

圖片:Anthropic

官方 benchmark 好睇,但身份要講清楚

Anthropic 公布嘅數據入面,Opus 5 喺 Frontier-Bench v0.1 擊敗其他參賽模型;CursorBench 3.2 開到 max effort 時,最高分只落後 Fable 5 約 0.5%。官方亦話佢喺 OSWorld 2.0 電腦操作測試,用略高過 Fable 5 三分一嘅工作成本已經壓過對方最佳成績,而 AutomationBench 最低 effort 嘅完成率仍高過其他模型。不過 Frontier-Bench 呢組結果係 Anthropic 自己跑,每題試五次,Opus 5 同 Fable 5 遇到安全攔截時仲會轉用 Opus 4.8。發布首日暫時未有同規模獨立測試,可以證實日常 codebase 都有同一差距;早期客戶評價有參考價值,但仍屬受邀試用數據。

計 agent 成本最易睇漏 effort

Claude 嘅 effort 分 low、medium、high、xhigh 同 max,會影響模型思考深度同時間,預設係 high。佢屬於軟性指引,唔會保證固定 token 數;內部思考 token 會當 output token 收費,舊對話保留落嚟嘅思考內容亦可能變成下一輪 input。coding agent 仲會反覆讀檔、跑測試、叫工具、修正再試,而每次工具循環都有自己嘅輸出上限,所以單次 max_tokens 封頂都鎖唔住成個 job 嘅總支出。簡單改名或整理文件可以先試 medium,跨模組重構同難查 bug 先推高 effort,咁樣通常較全程開盡實際。

另外,tokenizer 轉變都會影響實際成本。Anthropic 喺 Sonnet 5 遷移文件提醒,新 tokenizer 令同一段文字大約多 30% token,所以即使每百萬 token 價錢冇變,同一 request 都可能貴咗。Opus 5 今次所講嘅「半價」主要建基於 Fable 5 嘅 US$10/US$50 牌價;真正比較時,要一齊記錄完成率、總 input、思考同文字 output、工具調用次數、延遲同重試。模型一次做好,確實可能平過平價模型錯幾次,但呢點要用自己嗰批工作驗證。

Fable 5 適合咩工作

Fable 5 仲係 Anthropic 指定處理最複雜、最長時間自主工作嘅型號,尤其多日 agent、科研同高難度任務。不過 Opus 5 喺一批 coding、商業流程同電腦操作 benchmark 已經貼得好近,甚至有幾項由官方報稱反超,Fable 嘅雙倍價會較難喺一般工作量交代。大量、講求速度同成本敏感嘅工作,就可以先試 Sonnet 5。實際部署可以由 Sonnet 處理例行 job,難題升到 Opus,只有內部評測證明 Opus 搞唔掂嗰批先交畀 Fable,咁樣會易過全公司綁死單一模型。

API、Claude Code 同雲端平台點用

Opus 5 已上 Claude 各個付費方案,成為 Claude Max 預設模型,Pro 亦可以揀;Claude Code 同日支援,Fast mode 就按 usage credits 計。開發者可喺 Claude API 用 claude-opus-5。Anthropic 模型文件亦列出 Amazon Bedrock、Claude Platform on AWS、Google Cloud 同 Microsoft Foundry 支援現行 Claude 型號;企業用雲端帳戶前仍要核對所揀 region、model catalog、資料駐留同額外加價,因為區域 endpoint 可以有 10% surcharge。今次未見港幣 API 價或香港限定方案,做預算仍然要跟美元 token 用量計。

9to5Google 提到 Fable 5「差啲俾禁」,背景係美國政府 6 月 12 日向 Fable 5 同 Mythos 5 加入出口限制,Anthropic 因為未能即時核實用戶國籍,短暫停晒全球存取;限制到 6 月 30 日撤銷,服務 7 月 1 日恢復。呢段插曲同 Opus 5 本身能力冇直接關係。公司準備換模型,先抽一批真實 coding 同 agent job,用固定 harness 跑 Sonnet、Opus、Fable 各個 effort,再睇完成率同每個成功 job 嘅總成本;等獨立 benchmark 出齊之前,呢組數據會可靠過發布圖表。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook