
AMD Gorgon Halo 塞入 192GB RAM,本機跑 300B 模型有幾實際?
大容量解決模型載入,速度同軟件支援仍要逐項核對
AMD 喺 Advancing AI 2026 再講 Gorgon Halo,今次焦點係 192GB 統一記憶體,想畀大型模型、coding agent 同多個自動化代理喺一部細機入面運行。先執正時間線:呢批 Ryzen AI Max PRO 400 晶片早喺 5 月 20 日已經公布,7 月大會主要補充應用定位、軟件生態同合作方案,唔算首次亮相。
Halo 係部機,Gorgon Halo 係入面粒晶片
幾個相近名好易撈亂。Ryzen AI Halo 係 AMD 自家驗證嘅開發機平台,而家美國 Micro Center 賣緊嗰款用 Ryzen AI Max+ 395,配 128GB 統一記憶體。Gorgon Halo 就係 Ryzen AI Max PRO 400 系列嘅代號;稍後推出嘅新 Halo 開發機先會用 Max+ PRO 495,最高支援 192GB。AMD 亦話 HP、Lenovo 等 OEM 會喺 2026 年第三季推出相關產品,但暫時未見香港正式售價、保養同供應安排。
192GB 最直接嘅用途係裝得落巨型模型
大型模型推論好多時先卡喺容量。一個 300B 模型經 4-bit 量化,單計權重大約已佔 150GB,仲未包 KV cache、context、runtime 同其他程式。AMD 所講嘅「本機跑 300B」亦有註明係 4-bit 量化,Max+ PRO 495 最多可劃出 160GB 畀 GPU;換句話講,空間其實相當緊。模型載入到同用得順係兩回事,context 一拉長,或者同時開多個 agent,餘下記憶體好快就用晒。
統一記憶體嘅好處係 CPU 同 GPU 共用同一池 RAM,唔使先買幾張大 VRAM 顯示卡再拆模型。不過容量加到 192GB,唔代表 token 速度會按比例升。AMD 公布資料提到較高時脈,但未交代 Gorgon Halo 有冇同步提高記憶體頻寬;LLM 逐 token 生成往往受頻寬限制。Phoronix 測試現款 Max+ 395,確認 ROCm、vLLM 同 llama.cpp 跑得到,但亦見到 Vulkan 同 ROCm 後端表現會跟模型、版本而轉,未可以直接套落未出貨嘅 PRO 495。
Coding agent 同自動化先係較實際玩法
對開發團隊嚟講,吸引力未必係夾硬追最大參數量。30B 至 70B coding 模型,加長 context、repo 索引、embedding server 同幾個同時運行嘅 agent,通常實用過用晒 192GB 養一隻反應慢嘅 300B 模型。程式碼、客戶文件或者內部知識庫可以留喺公司部機,亦冇逐次 API 收費;但模型權重、套件供應鏈、agent 可執行權限同網上存取仍要自己管,放喺本機唔會自動變安全。
軟件支援唔可以淨睇 AMD 個 logo 牆
AMD 官方列出 PyTorch、vLLM、llama.cpp、Ollama、LM Studio 同 ComfyUI,但各套工具嘅成熟度唔同。ROCm 7.13 preview 已有 Ryzen AI Max 使用嘅 gfx1151 vLLM image;Ollama 官方 Linux 清單亦明列 Max+ 395,另可用 Vulkan。不過清單暫時未直接列出 Max+ PRO 495。新晶片仲未正式普及,Day-one driver、Windows GPU 加速、容器 image 同量化格式,都要等出貨版逐項驗證,唔好見到「支援 ROCm」就當所有模型即裝即跑。
「養龍蝦」講緊 OpenClaw,唔係新硬件能力
TechNews 科技新報用「養龍蝦」形容 OpenClaw 熱潮;OpenClaw 係可以接工具、瀏覽器同通訊服務嘅個人 AI agent,龍蝦只係佢嘅品牌意象。AMD 早喺 3 月已用現款 128GB Ryzen AI Max+ 示範 OpenClaw,經 WSL2、LM Studio 同 llama.cpp 跑本機模型。即係呢種玩法唔使等 Gorgon Halo;新平台主要畀多啲容量,方便加大模型、context 或同時運行嘅數量,唔會憑空令 agent 判斷準確,亦取代唔到權限隔離同人工覆核。
API 成本要用自己條數計
AMD 官網話 Halo 三年成本最高可低過雲端 API 六倍,但呢個係廠商估算:假設每日有效使用八小時、每日處理約 630 萬 token、連續跑三年,再用指定 Claude API 價格同美國電費比較。長期高用量團隊確實有機會慳到,偶爾先跑一次 coding agent 就未必。Max+ PRO 400 晶片本身 cTDP 可設喺 45W 至 120W,整機耗電、散熱、維護同模型更新亦要計入。
對有大量機密文件、穩定推論量或者多人共用模型嘅公司,Gorgon Halo 呢種大 RAM 細機值得等;一般開發者則可以先睇 128GB 平台嘅實際軟件表現。下一步最有參考價值嘅資料,會係 PRO 495 零售機用長 context 跑 llama.cpp、Ollama 同 vLLM 嘅獨立 token speed,同香港有冇正式銷售及保養。
參考來源
- TechNews 科技新報 — 養龍蝦風潮崛起,AMD Advancing AI 大會發布 Gorgon Halo 全新地端 AI 硬體架構 — original report
- AMD:Ryzen AI Halo 與 Ryzen AI Max PRO 400 系列公布 — 核對 5 月 20 日公布時間、192GB 記憶體、300B 量化條件、cTDP 同第三季供應資料
- AMD Ryzen AI Halo 產品頁 — 確認現售 128GB 開發機、Micro Center 渠道、軟件名單同廠商成本測試條件
- AMD ROCm:vLLM inference and serving — 核對 ROCm 7.13 preview 嘅 gfx1151 vLLM image 同安裝支援
- Ollama Hardware Support — 確認 Ryzen AI Max+ 395、ROCm 7 同 Vulkan 後端嘅官方支援狀況
- Phoronix:Ryzen AI Max+ 395 ROCm 7.0 測試 — 獨立驗證現款 Strix Halo 可跑 ROCm、vLLM 同 llama.cpp,亦比較 Vulkan 與 ROCm 後端
本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。







