
Qwen3.8-Max 正式版開放:平價挑戰 Claude,開發者值得試幾深?
一百萬 token、工具調用同平價 API,跑分仍要等獨立驗證
Qwen3.8-Max 最值得睇嘅地方,其實係阿里今次點樣將一個旗艦模型包成開發者即插即用嘅服務。一百萬 token context、function calling、內置工具、OpenAI 同 Anthropic 相容接口都齊,價錢亦明顯想搶 Claude 用家。不過,TechNews 科技新報報道所講嘅 2.4 兆參數同「媲美 Anthropic」,仍然要分開睇。
Preview 早已出現,8 月 3 日先推正式版
Qwen3.8-Max-Preview 其實早喺 7 月 19 日跟 Model Studio Token Plan 亮相,當時官方清楚標成預覽版本。去到 8 月 3 日,QwenCloud 文件先列出冇 Preview 字尾嘅 qwen3.8-max,仲將佢列入最高能力級別。所以今次重點係正式 endpoint 上線,同埋產品定位講清楚咗;唔應該當佢係從未曝光過嘅全新模型。
官方文件列明正式版有一百萬 token context、thinking、function calling、內置工具同 structured output。對 coding agent 嚟講,context 大係有用,但唔代表塞晒成個 repository 入去就自然識改 code;檔案揀選、工具回傳內容、指令層次同長對話入面會唔會走樣,照樣會影響結果。
2.4 兆參數夠搶眼,未講啟用量就唔好過度解讀
TechNews 科技新報引述綜合報道,指 Qwen3.8-Max 採用 MoE 架構,總參數量達 2.4 兆。MoE 每次生成 token 通常只會動用部分專家,所以總參數量唔等於每次推理實際用到嘅參數量。官方暫時未見公開啟用參數量、完整技術報告同可重現測試設定,單靠 2.4 兆呢個數,判斷唔到速度、成本或者 coding 水準。
同一報道話,Qwen3.8-Max 喺 coding agent、通用 agent 同長時間任務上,部分指標貼近甚至高過 Anthropic Fable 5。呢啲比較暫時只應該當成廠方成績表:未有足夠成熟嘅獨立測試,亦未清楚各項測試用咩 agent 框架、工具、reasoning budget 同重試次數。模型擺入唔同 coding 工具,結果可以差好遠,榜上接近唔代表改大型 codebase 都一樣可靠。
價錢有吸引力,但兩種 API 用法要分清
TechNews 科技新報報道,國際版按量 API 每百萬 input token 收 2 美元、output 收 6 美元,implicit cache hit 收 0.25 美元。呢個價確實有競爭力,尤其 agent 一次任務可能連續讀檔、改 code、跑測試,再重複幾輪。不過 QwenCloud 公開價目總表截稿時未列出 Qwen3.8-Max,正式接入前應以控制台報價同帳單規則再核對一次。
另一條路係 Token Plan,官方月費方案分別由 6、18 同 68 美元起,用 credits 計配額,適合 Claude Code、Qwen Code、OpenCode 呢類互動式 coding 工具。官方亦寫明呢個 plan 唔適合自動化 backend 服務;做產品 API 應用仍要用按量方案。兩者表面都叫 API key,計費、endpoint 同用途其實唔同,揀錯會令成本估算完全失準。
接 Claude Code 幾方便,工具能力先係實際賣點
QwenCloud 提供 Anthropic 相容 endpoint,官方文件亦有 Claude Code 設定方法;開發者換 base URL、API key 同 model name,就可以喺現有 coding 工具試用。模型支援 function calling,平台另外提供網上搜尋、網頁擷取、code interpreter 同圖片搜尋。呢套組合對 agent 任務幾實際,因為模型識唔識揀工具、讀回傳結果再繼續做,往往影響成件事做唔做得完。
不過相容接口唔代表行為完全一樣。官方特別提醒,Qwen 嘅 temperature 範圍同 Anthropic 有差異,thinking mode 同 reasoning effort 亦有自己規則。由 Claude 模型直接切過去,最好用同一批真實任務比較成功率、完成時間、token 用量、錯誤修改同重試次數,唔好淨係睇首次輸出順唔順眼。
值得試,但先放喺可覆核任務
如果團隊本身用 Claude Code 或 OpenAI 相容工具,Qwen3.8-Max 值得揀一個範圍清楚、方便覆核嘅項目試幾日:例如修 bug、補測試、整理多檔案重構方案,再由工程師逐項覆核。平價 API 加一百萬 token context,足以令佢成為認真候選;要直接取代成熟模型負責發版、資料庫 migration 或無人看管嘅長時間 agent 任務,現有獨立證據仍然未夠。
不過香港帳戶能否直接開通、接受咩付款方法、資料實際存放地區、跨境安排同企業條款,公開資料仍未交代得夠完整。公司接入前要向供應商逐項確認;至於模型本身,下一步就睇官方會唔會公開更完整嘅模型卡、技術報告,同埋有冇更多獨立 coding-agent 測試。
參考來源
- TechNews 科技新報 — 阿里千問 3.8-Max 模型上線,稱性能媲美 Anthropic — original report
- Qwen:Qwen3.8-Max 官方公告 — Qwen 官方發布頁,用嚟核對正式版定位同開放安排。
- QwenCloud:Text generation models — 官方模型文件,列出 context window、thinking、function calling、內置工具同 structured output 支援。
- QwenCloud:Claude Code 接入文件 — 官方接入指引,確認 Anthropic 相容 endpoint、模型設定同一百萬 token context 配置。
- Alibaba Cloud Model Studio:Token Plan for Individual — 官方月費、credits 配額、支援工具同使用限制資料。
- QwenCloud:API Pricing — 官方按量價目同工具調用收費說明,用嚟核對公開價目表覆蓋範圍。
本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。







