OpenAI 劈價 GPT-5.6:Luna 平八成,邊類 AI 工作最值得轉?
Tech News

OpenAI 劈價 GPT-5.6:Luna 平八成,邊類 AI 工作最值得轉?

圖片:via iThome — https://www.ithome.com.tw/news/177789
TechLab 編輯部(譯)·

由客服、coding agent 到內容處理,逐個工作量計清楚

OpenAI 喺 GPT-5.6 正式推出三星期內就劈價,Luna API 平八成,Terra 平兩成,Sol 就維持原價兼加入 Fast mode。呢次改動針對 API 成本,ChatGPT 同 Codex 訂閱價格、額度上限都冇減;只係 Terra、Luna 喺部分付費產品入面消耗嘅 credits 會少咗。對公司嚟講,真正值得睇嘅係一批原本嫌貴、只敢抽樣處理嘅工作,而家有冇可能全量交畀模型。

Luna 個新價,平到可以改寫工作分工

以 Standard、短 context 計,Luna 每 100 萬 input token 由 US$1 減至 US$0.20,output 由 US$6 減至 US$1.20;Terra 就由 US$2.50/US$15,減至 US$2/US$12。Sol 冇減,仍然係 US$5/US$30。OpenAI 官方話,減價來自模型、推理系統同 agent 框架效率改善;iThome 報道亦提到,三款模型 7 月 9 日先正式推出,今次調價來得相當快。

假設一份工作合共食 100 萬 input token,再產生 20 萬 output token,Luna Standard 只收 US$0.44,Terra 係 US$4.40,Sol 就係 US$11。用 US$1 兌 HK$7.8 粗略換算,即係約 HK$3.4、HK$34 同 HK$86。呢個差距大到足以改變 routing 做法:先交大量清晰、重複嘅步驟畀 Luna,撞到高風險判斷或者含糊要求,先升去 Terra 或 Sol。

Output token 好容易計漏

Luna 平得誇張,不過 output 價仍然係 input 六倍。以上面個例子計,20 萬 output 已經收 US$0.24,多少少過 100 萬 input 嘅 US$0.20;Terra 同樣有呢個比例。coding agent 如果不停解釋、重寫成份檔案或者喺工具之間兜圈,張單仍然可以膨脹。轉 Luna 同時收緊輸出格式、限制無效重試、保留可重用 context,通常慳得多過淨係換 model ID。

客服、coding agent 同內容工作點揀

客服如果每月處理 10 萬宗對話,每宗平均 2,000 input 加 500 output token,Luna Standard 約 US$100,即約 HK$780;Terra 同一用量約 US$1,000,即約 HK$7,800。分類、資料抽取、FAQ 配對同草擬簡單回覆,可以先試 Luna;涉及退款決定、合約條款、複雜情緒或者多個工具操作,Terra 多付嗰筆錢有機會換到少啲人工執漏,最終要用自家對話 eval 驗證。

coding agent 都可以拆開做。需求清楚嘅小改動、寫測試、跑 lint、整理失敗紀錄,Luna 個價適合做背景 worker;要理解大型 codebase、追跨系統 bug 或者決定架構,Terra、Sol 仍然穩陣啲。OpenAI 官方甚至用 Sol 規劃、Luna 實作同測試做例子。呢種分層比成條 agent chain 固定用同一款模型實際,亦較容易追蹤邊一步燒 token。

Batch 平一半,Fast 就要雙倍價

冇即時回覆要求嘅內容分類、舊文章補 metadata、大批摘要同 eval,Batch API 會喺 Standard 價再平 50%,官方寫明每批工作會喺 24 小時內完成。頭先 100 萬 input 加 20 萬 output 個例子,Luna Batch 只係 US$0.22,Terra US$2.20。夜晚排隊、第二朝攞結果嘅工作,揀 Batch 通常抵過為咗快幾秒畀多筆錢。

Fast mode 方向相反。Sol 短 context input、output 分別收 US$10 同 US$60,正好係 Standard 兩倍;同一工作量要 US$22,約 HK$172。OpenAI 講法係速度「最高」可達 Standard 2.5 倍,唔代表每次都快足 2.5 倍。Fast 亦唔支援 long context、fine-tuned models 同 embeddings;流量喺 15 分鐘內急升超過 50%,又達到至少每分鐘 100 萬 token,部分請求可能降返 Standard 速度同收費,供應亦要視乎地區規例。

Fast 較啱人等緊結果、每秒延遲都影響收入嘅高價值產品,例如互動 coding、即時事故分析或者繁忙時段嘅重要客服。ETL、大批內容轉換同離線 agent 冇理由硬畀雙倍價。Luna 減價之後,全量處理嘅成本壓力細咗,公司反而要集中測試輸出品質。下一步應該攞真實工作跑 eval,計埋錯誤返工同人工覆核,再決定有幾多流量可以轉過去。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook