
AMD Helios 正式埋位:用開放網絡同 ROCm 拆 NVIDIA AI 工廠圍牆
MI455X 規格夠狠,雲端客仲要睇軟件同供應跟唔跟得上
今次重點係成套系統正式埋位
AMD 早喺 CES 2026 預覽過 MI455X 同 Helios,所以今次唔算突然掟出一件全新產品。Advancing AI 2026 真正多咗嘅內容,係 MI400 系列正式推出,Helios 亦由概念走到完整機架方案。TechNews 科技新報報道,AMD 同場將焦點放喺大規模推論,官方亦確認 OpenAI、Anthropic、Meta、Microsoft 同 Oracle 等客戶或合作夥伴會部署相關系統。當中 OpenAI 預計 2026 年第四季開始啟用 Helios,代表呢套架構已經進入實際交付階段。
Helios 瞄準 NVIDIA 最穩陣嗰道護城河
MI455X 本身用 CDNA 5 架構,每粒有 432GB HBM4;一套 Helios 就放入 72 粒 MI455X、18 粒第六代 EPYC CPU,再加 Pensando 網絡同 ROCm 軟件。呢種砌法好關鍵,因為 NVIDIA 最難追嗰部分向來都唔只係 GPU,仲有 NVLink、網絡、CUDA 同整個機架一齊調校。AMD 而家終於交到同級嘅整套方案,直接向雲端商提供可複製嘅機架藍圖,唔使客戶自己逐件零件拼湊。
Helios 官方規格包括 2.9 exaflops FP4、1.4 exaflops FP8、合共 31TB HBM4,同埋 260TB/s 機架內 scale-up 頻寬。不過頭兩個數字係峰值理論算力,唔等於模型實際出 token 嘅速度。31TB HBM4 反而更容易理解:模型、KV cache 同較長 context 可以少啲跨機架搬資料,對大量 agent 同時運作特別有利。MI400 系列另外仲有偏向科學運算同主權 AI 嘅 MI430X,但 Helios 主力用嘅係 MI455X。
開放網絡係 AMD 最有殺傷力嗰張牌
Helios 用 UALink over Ethernet 做機架內互連,跨機架就採用配合 Ultra Ethernet Consortium 標準嘅 Pensando 網絡。對大型雲端商嚟講,呢個方向可以減少俾單一供應商由 GPU、交換器到軟件全部綁住,亦方便 OEM 按公開機架標準推出自己版本。AMD 官方亦講明 Helios 本身係參考設計,唔係一件直接零售嘅成品;合作廠商會按個藍圖生產系統,批量部署預計喺 2026 年下半年展開。
開放標準有選擇空間,實際效能就要睇整套系統點調校。高速互連對延遲、擁塞管理同軟件排程好敏感,規格表就算寫到同一級,實際跑大型模型都未必有同一表現。NVIDIA 已經累積多年機架級部署經驗,AMD 要證明 UALoE 喺多機架長時間運作下仍然穩定,OEM 亦要做到供電、液冷同維修一致,先可以令「開放」變成真正採購優勢。
「每美元多 30% token」要睇清楚細字
AMD 話 MI455X 跑 DeepSeek V4 Flash、FP4 推論時,token throughput 最高可達 MI355X 嘅 34 倍;呢個數字來自 AMD Performance Labs,涵蓋高、中、低互動負載,系統設定同軟件版本都會影響結果。至於 Helios 每美元最多多 30% token,AMD 用 Kimi K2 Thinking、32K input 加 8K output 作模型推算,再用市場情況估計兩邊 GPU 每小時價錢。換句話講,呢項對照仲未係第三方用兩套量產機架、同一張帳單跑出嚟嘅結果,暫時應該當成原廠成本目標。
ROCm 進步咗,CUDA 遷移成本仲未消失
ROCm 而家已支援 PyTorch、TensorFlow、JAX、vLLM、Triton 同 SGLang 等常用工具,AMD 今次亦推出 ROCm.ai,等 coding agent 協助開發者改寫同調校 GPU 程式。呢步有用,尤其開發流程已經圍住主流 framework 行,轉硬件唔一定要由底層重寫。不過現成模型行得郁,同跑到最抵嘅 token 成本仍然有段距離;kernel 優化、除錯工具、版本兼容同長期支援,全部都係 CUDA 生態累積多年嘅優勢。Anthropic 會用 Claude 協助 AMD 加快 ROCm 開發,某程度亦反映軟件工作仲喺快速補強。
雲端先係多數開發者接觸 Helios 嘅入口
Microsoft 已公布 Azure ND MI455X v7 VM,主攻 reasoning、搜尋同 agent 工作,底層會採用 Helios,但暫時冇交代公開租用日期同價錢。對香港開發者嚟講,經 Azure 租 AMD 算力會實際過自行部署液冷機架。市場多一套成熟平台,至少可以增加雲端算力供應,亦畀大型客戶多啲議價空間,長遠亦有機會壓低 AI 推論成本;至於節省到嘅錢會唔會反映喺 VM 或 API 收費,就要等正式價目、獨立 benchmark 同 ROCm 遷移工夫一齊出爐先睇得準。
參考來源
- TechNews 科技新報 — 直擊 AMD Advancing AI 2026 現場,新一代 Instinct MI400 系列與 Helios 平台發表,劍指 AI 工廠與前沿推論市場 — original report
- AMD:Advancing AI 2026 全端運算發佈 — 核對 Helios 客戶部署、ROCm.ai、MI400 路線圖同效能測試細節。
- AMD:Helios Rackscale Solution 官方資料 — 核對機架規格、對手比較、開放網絡設計同成本推算方法。
- AMD Helios 產品頁 — 核對 Helios 係參考設計、72 GPU 架構、支援標準同預計部署時間。
- Microsoft:Azure 擴充 AMD AI 基建 — 確認 Azure ND MI455X v7 會採用 Helios,亦確認暫未公布租用價同推出日期。
- AMD CES 2026 發佈 — 分清 Helios 同 MI455X 早喺 CES 預覽過,避免將舊消息當今次首次公開。
本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。







