AMD EPYC 9006 Venice 推到 256 核心,agentic AI 點解仲要靠 CPU
Tech News

AMD EPYC 9006 Venice 推到 256 核心,agentic AI 點解仲要靠 CPU

圖片:via TechNews 科技新報 — https://technews.tw/2026/07/24/live-coverage-of-amds-6th-generation-epyc-venice-server-processor-launch/
TechLab 編輯部(譯)·

2nm、闊 RAM 頻寬同更多核心,主攻 AI server 背後嘅繁重雜務

GPU 忙住推理,CPU 其實都冇得抖

講 agentic AI,好多人第一時間都係望住 GPU,但一個 agent 由收到指令到交出答案,中間仲有大堆工作要 CPU 處理:搵企業資料、叫 API、跑 Python、開隔離 sandbox、查 database、驗證結果,再將成個流程串返埋。當同一時間由幾十個 agent 變成幾千個,CPU thread、RAM bandwidth 同 I/O 好快就會塞車。EPYC 9006 Venice 今次瞄準嘅,就係呢堆容易俾 GPU 光環遮住嘅工作。

AMD 用 Zen 6 同較密集嘅 Zen 6c 核心,最高階 EPYC 9996 單粒有 256 核心、512 threads,Default CPU Power 去到 600W。平台亦加到 16-channel DDR5,支援 8,000 MT/s RDIMM、最高 12,800 MT/s MRDIMM、PCIe 6.0 同 CXL 3.1。上一代 EPYC 9005 最高有 192 核心同 12-channel RAM,所以 Venice 嘅方向好清楚:同一個 socket 擺入更多工作,同時擴闊餵資料入核心嘅通道,減少高併發工作互相爭資源。

2nm 幫到密度,唔代表電力突然變平

Venice 採用台積電 2nm 製程,AMD 早喺 5 月已公布開始提升產量。製程縮細可以容納更多核心,亦有助控制每個 thread 嘅耗電,不過 256 核心型號本身仍可用到 600W,裝入雙路 server 後,仲未計 RAM、network、SSD、散熱同電源損耗。資料中心真正計嘅係一個 rack 喺固定電力下做到幾多工作,而唔會淨係睇粒 CPU 個數字。

AMD 聲稱,82 部雙路 EPYC 9996 server 可以取代 1,000 部用 Xeon Gold 6258R 嘅舊機,功耗減 77%,三年總持有成本低 40%。呢組數字係 AMD 模型推算,而且拿 2020 年前後嘅 28 核心 Xeon 同 2026 年旗艦比較,世代同核心數差距都極大。舊機房換代確實可能慳位慳電,但實際慳幾多仍要睇軟件授權按核心定按 server 收費、平均負載、RAM 容量同搬遷成本,82 對 1,000 唔可以直接套落每間公司。

Venice 同 Vera 各自搶緊邊個位置

NVIDIA Vera 用 88 粒自家 Olympus Arm 核心、單一 compute die 同最高 1.2TB/s LPDDR5X RAM bandwidth,亦可經 NVLink-C2C 用最高 1.8TB/s coherent bandwidth 直駁 Rubin GPU。佢重視每核心表現、穩定延遲同 CPU、GPU 之間搬資料嘅速度,放入 Vera Rubin 系統時尤其順手。EPYC 就保留較通用嘅 x86 server 路線,用更多核心、標準 DDR5或 MRDIMM、PCIe 同 CXL,方便雲端、database、HPC、虛擬化同 AI 工作混合部署。

兩者定位點樣分,會直接影響實際點揀。大量獨立 sandbox、web service 同工具執行可以食盡 EPYC 嘅 thread 密度;如果工作要 CPU 同 Rubin GPU 密密交換資料,Vera 嘅 NVLink-C2C 會有架構優勢。AMD 亦預告 2027 年下半年推出低功耗 LPDDR5X、SOCAMM2 模組嘅 EPYC 9006 LP「Verano」,專門做 AI host node。AMD 加推 Verano,正正係要補返傳統插槽式 DDR server CPU 應付唔到嘅 AI rack 工作。

廠方跑分先當路線圖睇

TechNews 科技新報報道,AMD 公布嘅 SPECrate 2026_int_base 數據顯示,256 核心 Venice 總吞吐量係 Vera 嘅 2.2 倍,每核心表現高 20%;對 Intel Xeon 6980P 嘅比較亦由 AMD 提供。AMD 官網另一組 100kW rack 模型就聲稱 EPYC 9996 綜合表現可達 Vera 嘅 3.3 倍,不過註腳寫明結果混合咗內部測試、第三方數據同工程推算,agent 數量部分更以可用 threads 做代用指標。

換句話講,呢啲數據暫時適合用嚟理解 AMD 想點樣賣 Venice,未足以證明實際 agent 平台真有同等差距。Phoronix 指獨立 EPYC 9006 benchmark 仲要等測試機,亦話首批 SP7 server 預計第四季先正式供應。下一步值得睇嘅係固定整機功耗下,Venice 跑 sandbox、database、web serving 同 GPU feeding 嘅持續表現,仲有 MRDIMM 帶來嘅 bandwidth 夠唔夠抵銷成本同耗電。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook