
AMD 搬出 Helios 全機櫃追 NVIDIA,2,000 倍推論效能點解唔可以照單全收
EPYC、Instinct 同 ROCm 一齊上,成敗要睇部署成本同軟件成熟度
AMD 今次賣成套 AI 基建
AMD 喺 Advancing AI 2026 推出 Helios,思路幾清楚:客戶買嘅唔再只係一粒 GPU,而係由 72 粒 Instinct MI455X、18 粒第六代 EPYC「Venice」、Pensando 網絡到 ROCm 軟件砌成嘅完整機櫃。NVIDIA 多年嚟靠 GPU、NVLink、網絡同 CUDA 綁成一套成熟平台,AMD 而家正面追同一個戰場。EPYC 負責資料準備、模型調度同餵飽加速器,Instinct 做主要運算,Helios 就將各部分預先夾好,減少雲端商自己整合嘅功夫。

圖片:AMD
個 2,000 倍點計出嚟
TechNews 科技新報報道,AMD 預計,一套 MI500 AI 機櫃對比一套 MI300X 平台,2023 至 2027 年間嘅推論吞吐量升幅會超過 2,000 倍。數字好搶眼,不過 AMD 簡報腳註寫得好關鍵:基準係一套 MI500 AI 機櫃對一套 MI300X 平台嘅理論峰值運算效能推算,資料來自 AMD Performance Labs 2025 年 12 月嘅工程預測。換句話講,呢次比較同時換咗晶片世代、HBM、互連、低精度格式同系統規模,亦冇提供同一模型、輸入輸出長度、延遲要求或者 tokens/s 成績。AMD 年初講 MI500 對 MI300X 最多有 1,000 倍 AI 效能,今次升到 2,000 倍,正好反映比較範圍已經擴至整個機櫃。

圖片:AMD
MI455X 嘅 34 倍同樣有條件
已經推出嘅 MI455X,AMD 官方話 token 吞吐量最高可達 MI355X 嘅 34 倍。呢項內部測試用 DeepSeek V4 Flash、FP4 精度,再綜合高、中、低互動性設定;佢有實際工作負載做基礎,參考價值高過 MI500 嘅遠期推算,但仍然唔代表每個模型都有同樣升幅。FP4、模型結構、batch 大小、首個 token 延遲同同時用戶數,都會大幅改變結果。買家要睇自己跑緊嗰套模型同服務目標,單靠一個峰值倍數作決定太冒險。
大客戶實際部署有參考價值過路線圖
Microsoft 已確認會喺 Azure 部署 Helios,AMD 話 2026 年下半年開始出貨;OpenAI 預計同年第四季開始上線,之後喺 2027 年加快擴充。AMD 同 Meta、OpenAI 各有最多 6GW 嘅跨世代合作,Anthropic 亦公布最多 2GW 部署,仲會用 Claude 協助改善 ROCm。呢批客戶有能力安排工程團隊貼身調校,對 AMD 最有價值嘅地方係提供真實模型、網絡同軟件壓力。ROCm 能否喺一般企業環境保持相容、穩定同容易維護,仍要等更廣泛部署先有答案。
算力競爭未必即刻令 API 減價
AMD 估算 Helios 跑 Kimi K2 Thinking 時,每美元可產生嘅 token 最多高過 NVIDIA Vera Rubin NVL72 約 30%。呢項比較同樣由 AMD 自己推算,仲用咗預計中嘅 GPU 每小時價格,未計資料中心電力、網絡、故障率、人手同軟件遷移成本。若 Microsoft 等雲端商真係大規模加入 AMD,企業用 Azure 或雲端 AI API 時,會多一個算力來源,供應緊張嗰陣尤其有用。不過雲端商會唔會把節省到嘅成本反映喺收費,始終由市場需求同定價策略話事。
下一步睇實際交付同 ROCm
AMD 已經由賣加速卡行到交付完整機櫃,亦搵到幾間最有份量嘅 AI 公司參與部署,呢點有說服力過一長串未來代號。到 Helios 喺 Azure、OpenAI、Meta 同 Anthropic 正式運行後,外界要對照相同模型、延遲、功耗、機櫃數量同服務成本,先判斷 AMD 同 NVIDIA 真正差幾遠。現階段可以確認嘅係競爭選擇多咗;至於 2,000 倍,暫時只適合當成 AMD 對 2027 年完整系統嘅目標。
參考來源
- TechNews 科技新報 — 蘇姿丰揭示未來藍圖,EPYC 與 Instinct 世代交替引領 AI 推論效能飆升 2,000 倍 — original report
- AMD:Advancing AI 2026 全端 AI 基建發布 — 確認 Helios 配置、MI455X 測試條件、客戶部署、ROCm 更新同每美元 token 宣稱。
- AMD Advancing AI 2026 Keynote Slides — 簡報同腳註交代 2,000 倍來自 MI500 AI 機櫃對 MI300X 平台嘅工程推算。
- AMD:Microsoft 將於 Azure 部署 Helios — 確認 Azure 用途、Helios 組成同 2026 年下半年出貨安排。
- AMD 與 OpenAI 6GW 合作公告 — 確認 OpenAI 跨世代 Instinct 合作規模同首階段部署計劃。
- AMD 與 Meta 6GW 合作公告 — 確認 Meta 自訂 MI450、Helios 架構、EPYC 同 ROCm 部署背景。
- AMD:MI355X 推論效能技術文章 — 補充 ROCm、SGLang、模型設定同軟件調校對推論吞吐量嘅實際影響。
本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。







