OpenAI、Anthropic齊推平價模型:coding agent帳單點先計得準
Tech News

OpenAI、Anthropic齊推平價模型:coding agent帳單點先計得準

圖片:via Ars Technica — https://arstechnica.com/ai/2026/08/openai-and-anthropic-in-price-war-as-chinese-ai-rivals-gain-ground/
TechLab 編輯部(譯)·

Luna 大減八成,Opus 5 半價貼近 Fable,cache 命中率同輸出量最影響實際開支

Ars Technica 將呢輪新模型形容做 AI「price war」:公司開始控制愈滾愈大嘅 AI 帳單,DeepSeek、Moonshot 呢類平價選擇亦逐步搶到歐美開發者。不過,暫時冇公開證據證明 OpenAI、Anthropic 直接因為中國對手而減價;OpenAI 自己嘅解釋係模型、推理系統同 agent 架構慳到運算成本。競爭壓力好合理,但因果關係要分開講。

兩種「減價」,玩法其實唔同

OpenAI 係直接劈 GPT‑5.6 Luna 價錢。按 7 月 30 日公告,新價係每百萬輸入 token US$0.20、輸出 US$1.20,平咗八成;Codex 同 ChatGPT Work 訂閱價同 quota 冇變,但 Luna、Terra 會扣少啲 credits。Anthropic 嘅講法巧妙啲:Claude Opus 5收 US$5/US$25,價錢同 Opus 4.8 一樣;所謂「半價」係同 US$10/US$50 嘅 Fable 5 比。即係 OpenAI 真係將同一模型減價,Anthropic就用原有 Opus 價位提供一個官方聲稱接近 Fable 嘅新模型。

由多款復古鳥蛋圖案砌成數字 5,係 Claude Opus 5 官方發布配圖

圖片:Anthropic

擺同一桶 token 落去,差距有幾大

假設每月固定用 1 億 uncached 輸入 token,加 2,000 萬輸出 token,先忽略稅項、長上下文、batch 同 cache:Luna 約 US$44,Opus 5 約 US$1,000Kimi K3按 US$3/US$15 計約 US$600DeepSeek V4 Flash 按 US$0.14/US$0.28 計只係 US$19.60,Pro 按 US$0.435/US$0.87 計就約 US$60.90。呢條數只反映價單,冇計完成工作嘅質素,但 Luna 減價後的確踩入中國模型向來佔優嘅成本區間。

每百萬 token 平,張單未必照比例跌

Coding agent 會不停讀 code、工具結果同先前對話,cache 命中率可以大幅改變成本。DeepSeek V4 Flash 嘅 cache-hit 輸入價低至 US$0.0028,Kimi K3 係 US$0.30;Anthropic 同 OpenAI 亦有 cache read 折扣,不過寫入 cache 另有收費。仲有 tokenizer 差異:Anthropic 文件話 Opus 4.7 或之後嘅模型,同一段文字大約會產生多 30% token,實際幅度視乎內容。長上下文、reasoning effort 同工具重試亦會改變輸出量,所以跨平台淨睇 US$/MTok,好容易睇少咗真正開支。

「接近旗艦」要睇獨立測試點講

Anthropic 話 Opus 5 喺自家 CursorBench 測試,以一半成本做到貼近 Fable 5 嘅成績;Moonshot 就將 Kimi K3 定位做長時間 coding 同完整知識工作。獨立嘅 Artificial Analysis 測試提供咗另一把尺:Opus 5 high effort 喺 Intelligence Index 得 61 分,Kimi K3 max 得 60 分,兩者確實幾接近。不過 effort 設定唔同,唔可以當正式對決;同一測試亦錄得 Kimi 約 39 tokens/s、Opus 約 52 tokens/s,而 Kimi 跑完整套評估用咗多好多輸出 token。平價模型如果寫得長、等得耐或者多重試幾次,價差自然會收窄。

Coding agent 會先食到減價紅利

Codex、Claude Code 同公司內部自動化最啱做模型分流:高階模型負責拆問題、揀方案同最後 review,Luna、DeepSeek 呢類平模型就跑已經定義清楚嘅修改、測試、分類同背景 sub-agent。OpenAI 官方亦用 Sol 規劃、Luna 執行做例子。咁樣分工之後,每個工作都只用最強模型,成本上會愈來愈講唔通,尤其係每日跑幾千次工具呼叫嘅 startup 同公司團隊;香港開發者用美元畀 API 費,減價亦會直接反映喺每月帳單。

公司揀模型,價錢之外仲有幾關

平價 endpoint 要同時過可靠度、速度、工具支援、資料政策同供應穩定性。Kimi K3 推出後一度因需求太大暫停新訂閱,正好提醒大家:benchmark 同價單靚,未必代表高峰時間都交到同一服務水平。開發團隊值得用自己嘅 repository、prompt 同工具鏈計「每個成功任務成本」,連失敗率、人工執手尾同延遲一齊記。下一輪競爭要睇 Luna 減價可唔可以長期維持,仲有 Anthropic 會唔會再郁 Sonnet 同 Opus 價位。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook