AMD Helios 正式埋位:用開放網絡同 ROCm 拆 NVIDIA AI 工廠圍牆
Tech News

AMD Helios 正式埋位:用開放網絡同 ROCm 拆 NVIDIA AI 工廠圍牆

圖片:via TechNews 科技新報 — https://finance.technews.tw/2026/07/24/the-new-generation-instinct-mi400-series-and-helios-platform-were-announced/
TechLab 編輯部(譯)·

MI455X 規格夠狠,雲端客仲要睇軟件同供應跟唔跟得上

今次重點係成套系統正式埋位

AMD 早喺 CES 2026 預覽過 MI455X 同 Helios,所以今次唔算突然掟出一件全新產品。Advancing AI 2026 真正多咗嘅內容,係 MI400 系列正式推出,Helios 亦由概念走到完整機架方案。TechNews 科技新報報道,AMD 同場將焦點放喺大規模推論,官方亦確認 OpenAI、Anthropic、Meta、Microsoft 同 Oracle 等客戶或合作夥伴會部署相關系統。當中 OpenAI 預計 2026 年第四季開始啟用 Helios,代表呢套架構已經進入實際交付階段。

Helios 瞄準 NVIDIA 最穩陣嗰道護城河

MI455X 本身用 CDNA 5 架構,每粒有 432GB HBM4;一套 Helios 就放入 72 粒 MI455X、18 粒第六代 EPYC CPU,再加 Pensando 網絡同 ROCm 軟件。呢種砌法好關鍵,因為 NVIDIA 最難追嗰部分向來都唔只係 GPU,仲有 NVLink、網絡、CUDA 同整個機架一齊調校。AMD 而家終於交到同級嘅整套方案,直接向雲端商提供可複製嘅機架藍圖,唔使客戶自己逐件零件拼湊。

Helios 官方規格包括 2.9 exaflops FP4、1.4 exaflops FP8、合共 31TB HBM4,同埋 260TB/s 機架內 scale-up 頻寬。不過頭兩個數字係峰值理論算力,唔等於模型實際出 token 嘅速度。31TB HBM4 反而更容易理解:模型、KV cache 同較長 context 可以少啲跨機架搬資料,對大量 agent 同時運作特別有利。MI400 系列另外仲有偏向科學運算同主權 AI 嘅 MI430X,但 Helios 主力用嘅係 MI455X。

開放網絡係 AMD 最有殺傷力嗰張牌

Helios 用 UALink over Ethernet 做機架內互連,跨機架就採用配合 Ultra Ethernet Consortium 標準嘅 Pensando 網絡。對大型雲端商嚟講,呢個方向可以減少俾單一供應商由 GPU、交換器到軟件全部綁住,亦方便 OEM 按公開機架標準推出自己版本。AMD 官方亦講明 Helios 本身係參考設計,唔係一件直接零售嘅成品;合作廠商會按個藍圖生產系統,批量部署預計喺 2026 年下半年展開。

開放標準有選擇空間,實際效能就要睇整套系統點調校。高速互連對延遲、擁塞管理同軟件排程好敏感,規格表就算寫到同一級,實際跑大型模型都未必有同一表現。NVIDIA 已經累積多年機架級部署經驗,AMD 要證明 UALoE 喺多機架長時間運作下仍然穩定,OEM 亦要做到供電、液冷同維修一致,先可以令「開放」變成真正採購優勢。

「每美元多 30% token」要睇清楚細字

AMD 話 MI455X 跑 DeepSeek V4 Flash、FP4 推論時,token throughput 最高可達 MI355X 嘅 34 倍;呢個數字來自 AMD Performance Labs,涵蓋高、中、低互動負載,系統設定同軟件版本都會影響結果。至於 Helios 每美元最多多 30% token,AMD 用 Kimi K2 Thinking、32K input 加 8K output 作模型推算,再用市場情況估計兩邊 GPU 每小時價錢。換句話講,呢項對照仲未係第三方用兩套量產機架、同一張帳單跑出嚟嘅結果,暫時應該當成原廠成本目標。

ROCm 進步咗,CUDA 遷移成本仲未消失

ROCm 而家已支援 PyTorch、TensorFlow、JAX、vLLM、Triton 同 SGLang 等常用工具,AMD 今次亦推出 ROCm.ai,等 coding agent 協助開發者改寫同調校 GPU 程式。呢步有用,尤其開發流程已經圍住主流 framework 行,轉硬件唔一定要由底層重寫。不過現成模型行得郁,同跑到最抵嘅 token 成本仍然有段距離;kernel 優化、除錯工具、版本兼容同長期支援,全部都係 CUDA 生態累積多年嘅優勢。Anthropic 會用 Claude 協助 AMD 加快 ROCm 開發,某程度亦反映軟件工作仲喺快速補強。

雲端先係多數開發者接觸 Helios 嘅入口

Microsoft 已公布 Azure ND MI455X v7 VM,主攻 reasoning、搜尋同 agent 工作,底層會採用 Helios,但暫時冇交代公開租用日期同價錢。對香港開發者嚟講,經 Azure 租 AMD 算力會實際過自行部署液冷機架。市場多一套成熟平台,至少可以增加雲端算力供應,亦畀大型客戶多啲議價空間,長遠亦有機會壓低 AI 推論成本;至於節省到嘅錢會唔會反映喺 VM 或 API 收費,就要等正式價目、獨立 benchmark 同 ROCm 遷移工夫一齊出爐先睇得準。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook