傳 DeepSeek 喺內蒙古規劃 1GW AI 資料中心,成事要睇晶片同供電
Tech News

傳 DeepSeek 喺內蒙古規劃 1GW AI 資料中心,成事要睇晶片同供電

圖片:via TechNews 科技新報 — https://technews.tw/2026/07/31/deepseek-is-developing-massive-ai-data-center-in-inner-mongolia/
TechLab 編輯部(譯)·

匿名消息透露部分設施最快 2027 年底啟用,官方暫時未確認規模

TechNews 科技新報引述中媒轉述彭博報道,匿名知情人士話 DeepSeek 計劃喺內蒙古烏蘭察布增加 1GW 規模嘅 AI 資料中心容量,同時會向其他公司租額外算力。報道估計,部分容量最快喺 2027 年底至 2028 年初投入運作。要講清楚,呢個項目仲係規劃階段,DeepSeek 暫時冇公開確認,晶片型號、供電方案同工程進度都未有答案。

1GW 量度電力,唔可以直接當 GPU 數目

GW 係功率單位,1GW 即係 1,000MW,新聞所講嘅「1GW 算力」其實幾含糊。佢可能代表整個園區可輸入嘅電力,亦可能只計 IT 設備負載,兩種口徑會差一截。GPU 型號、每櫃密度、散熱方法同 PUE 全部都會影響最終運算能力,所以單憑 1GW 推算有幾多張晶片,得出嚟嘅數字冇乜意思。

如果假設 1GW 代表全站輸入功率,又全年每一刻都滿載,數學上相當於 87.6 億度電。實際用量當然會受分期啟用、設備使用率同維修時間影響,不過呢條數已經講到個量級有幾誇張。呢類項目要處理嘅唔止係買 server,仲有變電、輸電、後備電源、散熱同穩定供電,任何一環跟唔上,機房起好都未必跑得足。

「平價訓練」背後仍然要養成套基建

DeepSeek-V3 技術報告披露,完整訓練用咗 278.8 萬個 H800 GPU 小時,官方按每 GPU 小時 2 美元計出約 557.6 萬美元。個數只涵蓋正式訓練,冇計前期研究、架構實驗同失敗嘗試等研發成本。所以外界成日講嘅「幾百萬美元練出大模型」,本身只係整盤數入面一個窄口徑,唔代表經營 AI 平台真係咁平。

自建資料中心可以鎖定長期容量,調校網絡、儲存同散熱時亦有多啲話事權,對大型訓練同長時間推理服務都有用。不過固定資產要長期有人用先抵,DeepSeek 傳出一邊自建、一邊租算力,反而幾合理:穩定負載放入自家機房,模型衝刺期或者突然多人用嗰陣,再靠外租資源頂上,唔使為短期高峰永久養住全部設備。

烏蘭察布有氣候優勢,但散熱只係其中一環

DeepSeek 官方招聘頁而家列有烏蘭察布市嘅 IDC 資料中心團隊職位,至少證明公司確實喺當地請相關人手。工信部公開嘅另一個烏蘭察布資料中心個案顯示,當地低溫環境可容許機房一年約十個月用自然冷源;嗰個華為雲項目喺自然冷卻月份錄得約 1.22 PUE。不過呢啲係其他設施嘅成績,唔代表 DeepSeek 新項目一定做到同一水平。

當地政府早已將烏蘭察布定位做算力樞紐,公開資料提到區內有直達北京嘅光纜、綠色供電項目同多個大型資料中心。平地、較凍嘅天氣同能源供應,的確有利控制營運成本。不過 1GW 長期負載仍然考驗輸電容量同能源組合;就算 PUE 做得低,GPU 本身食幾多電都避唔到,綠電比例亦要等 DeepSeek 公布先知。

用咩晶片,會直接影響呢座機房值幾多

DeepSeek-V3 曾用 Nvidia H800 訓練,但呢款晶片其後受美國出口限制影響。路透社 7 月報道就話 DeepSeek 正研究自家推理晶片,項目仲喺早期,同時公司過往亦依賴 Nvidia 同華為硬件。新資料中心最後採用邊間供應商仍然未明,呢點會左右機櫃密度、互連網絡、軟件相容性、耗電量同實際可用算力,影響遠大過「1GW」呢個單一標籤。

DeepSeek 如果真係逐步搬到國產 AI 晶片,工程團隊就要花更多時間處理編譯器、通訊效率同模型框架適配;好處係供應較少受美國出口政策牽動。據報自家晶片會先用喺推理,訓練就可能繼續用其他平台,所以同一個園區可能會同時運行幾套硬件平台。混合架構彈性高,但維護、排程同軟件調校自然複雜好多。

對用戶嘅影響仲未到價格表

更大容量有機會改善 DeepSeek 服務繁忙、API 供應同每個 token 嘅成本,不過由規劃去到用戶真正受惠,中間仲隔住晶片交付、供電、網絡同軟件適配。現階段冇港區價格、可用性或者資料處理安排改動,香港用戶同開發者未使因為 1GW 傳聞改部署決定。下一步值得睇嘅,係 DeepSeek會唔會確認項目、首批容量用咩晶片,同實際幾時開始提供服務。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook