Qwen3.8-Max 正式版開放:平價挑戰 Claude,開發者值得試幾深?
Tech News

Qwen3.8-Max 正式版開放:平價挑戰 Claude,開發者值得試幾深?

圖片:via TechNews 科技新報 — https://technews.tw/2026/08/03/alibaba-qwen3-8-max/
TechLab 編輯部(譯)·

一百萬 token、工具調用同平價 API,跑分仍要等獨立驗證

Qwen3.8-Max 最值得睇嘅地方,其實係阿里今次點樣將一個旗艦模型包成開發者即插即用嘅服務。一百萬 token context、function calling、內置工具、OpenAI 同 Anthropic 相容接口都齊,價錢亦明顯想搶 Claude 用家。不過,TechNews 科技新報報道所講嘅 2.4 兆參數同「媲美 Anthropic」,仍然要分開睇。

Preview 早已出現,8 月 3 日先推正式版

Qwen3.8-Max-Preview 其實早喺 7 月 19 日跟 Model Studio Token Plan 亮相,當時官方清楚標成預覽版本。去到 8 月 3 日,QwenCloud 文件先列出冇 Preview 字尾嘅 qwen3.8-max,仲將佢列入最高能力級別。所以今次重點係正式 endpoint 上線,同埋產品定位講清楚咗;唔應該當佢係從未曝光過嘅全新模型。

官方文件列明正式版有一百萬 token context、thinking、function calling、內置工具同 structured output。對 coding agent 嚟講,context 大係有用,但唔代表塞晒成個 repository 入去就自然識改 code;檔案揀選、工具回傳內容、指令層次同長對話入面會唔會走樣,照樣會影響結果。

2.4 兆參數夠搶眼,未講啟用量就唔好過度解讀

TechNews 科技新報引述綜合報道,指 Qwen3.8-Max 採用 MoE 架構,總參數量達 2.4 兆。MoE 每次生成 token 通常只會動用部分專家,所以總參數量唔等於每次推理實際用到嘅參數量。官方暫時未見公開啟用參數量、完整技術報告同可重現測試設定,單靠 2.4 兆呢個數,判斷唔到速度、成本或者 coding 水準。

同一報道話,Qwen3.8-Max 喺 coding agent、通用 agent 同長時間任務上,部分指標貼近甚至高過 Anthropic Fable 5。呢啲比較暫時只應該當成廠方成績表:未有足夠成熟嘅獨立測試,亦未清楚各項測試用咩 agent 框架、工具、reasoning budget 同重試次數。模型擺入唔同 coding 工具,結果可以差好遠,榜上接近唔代表改大型 codebase 都一樣可靠。

價錢有吸引力,但兩種 API 用法要分清

TechNews 科技新報報道,國際版按量 API 每百萬 input token 收 2 美元、output 收 6 美元,implicit cache hit 收 0.25 美元。呢個價確實有競爭力,尤其 agent 一次任務可能連續讀檔、改 code、跑測試,再重複幾輪。不過 QwenCloud 公開價目總表截稿時未列出 Qwen3.8-Max,正式接入前應以控制台報價同帳單規則再核對一次

另一條路係 Token Plan,官方月費方案分別由 6、18 同 68 美元起,用 credits 計配額,適合 Claude Code、Qwen Code、OpenCode 呢類互動式 coding 工具。官方亦寫明呢個 plan 唔適合自動化 backend 服務;做產品 API 應用仍要用按量方案。兩者表面都叫 API key,計費、endpoint 同用途其實唔同,揀錯會令成本估算完全失準。

接 Claude Code 幾方便,工具能力先係實際賣點

QwenCloud 提供 Anthropic 相容 endpoint,官方文件亦有 Claude Code 設定方法;開發者換 base URL、API key 同 model name,就可以喺現有 coding 工具試用。模型支援 function calling,平台另外提供網上搜尋、網頁擷取、code interpreter 同圖片搜尋。呢套組合對 agent 任務幾實際,因為模型識唔識揀工具、讀回傳結果再繼續做,往往影響成件事做唔做得完。

不過相容接口唔代表行為完全一樣。官方特別提醒,Qwen 嘅 temperature 範圍同 Anthropic 有差異,thinking mode 同 reasoning effort 亦有自己規則。由 Claude 模型直接切過去,最好用同一批真實任務比較成功率、完成時間、token 用量、錯誤修改同重試次數,唔好淨係睇首次輸出順唔順眼。

值得試,但先放喺可覆核任務

如果團隊本身用 Claude Code 或 OpenAI 相容工具,Qwen3.8-Max 值得揀一個範圍清楚、方便覆核嘅項目試幾日:例如修 bug、補測試、整理多檔案重構方案,再由工程師逐項覆核。平價 API 加一百萬 token context,足以令佢成為認真候選;要直接取代成熟模型負責發版、資料庫 migration 或無人看管嘅長時間 agent 任務,現有獨立證據仍然未夠。

不過香港帳戶能否直接開通、接受咩付款方法、資料實際存放地區、跨境安排同企業條款,公開資料仍未交代得夠完整。公司接入前要向供應商逐項確認;至於模型本身,下一步就睇官方會唔會公開更完整嘅模型卡、技術報告,同埋有冇更多獨立 coding-agent 測試。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook