#GPU
42 篇文章
TechLab 所有關於「GPU」嘅文章、評測同教學,由最新排起。
Tech NewsNvidia 手上 1.23 億股 SpaceX,來源線索指向 xAI 換股
Nvidia 季末持有約 1.23 億股 SpaceX,申報價值接近 210 億美元。股份好大機會來自早年投資 xAI 後換股,不過公開文件未足以還原全部交易。持股令雙方利益靠近,但 SpaceX 嘅 GPU 供應仍然主要靠逐張訂單,未見長期採購量保證。
Tech NewsKog 單一 kernel 推到 3,000 tokens/s:coding agent 點解最食延遲
Kog 話自家推理引擎可喺 8 張 MI300X 上跑到每秒 3,000 個輸出 token。個數字夠搶眼,不過真正值得睇嘅係佢點樣壓低單一請求延遲,同埋呢套方法搬去大型第三方模型時會遇到咩限制。
Tech NewsNvidia 拉埋華爾街撐 AI 基建,5,000 億融資點樣放大 GPU 需求
Nvidia 搵嚟六間金融巨頭,計劃為 AI 基建動員逾 5,000 億美元第三方資金。呢個安排可以降低客戶買 GPU 同起數據中心嘅門檻,亦會令供應商、投資者同客戶綁得更實。交易本身未等於假需求,不過算力收入一旦追唔上擴建速度,GPU 殘值、雲端價格同 Nvidia 估值都會受壓。
Tech News傳 Nemotron 4 至少一萬億參數,輝達由賣 GPU 再攻模型層
NVIDIA 已確認 Nemotron 4 系列正在籌備,但一萬億參數同最快秋末完成仍然只係匿名消息。值得留意嘅係,輝達正由 GPU、CUDA 同雲端基建一路擴到模型層,想開發者由訓練到部署都用佢嗰套生態。
Tech NewsAWS AgentCore 加入 Runtime Instances:AI agent 跑足幾日有代價
AgentCore Runtime Instances 將 AI agent 搬到 AWS 代管嘅 EC2,工作階段上限由 8 小時拉長至 14 日,又支援 GPU、多 agent 共用檔案同停止後恢復。不過長達 14 日只係生命週期上限,開發者仍然要自己處理 checkpoint、重試、成本同資源爭用。
Tech NewsAMD 簽協議擬收購 Taalas:AI 模型直接入晶片,快得有代價
AMD 想買入 Taalas 嘅固定模型晶片技術,避開 GPU 搬運模型權重嘅效率樽頸。不過 HC1 嘅高速數字來自廠方自測,模型更新、低精度量化同大晶片量產風險,全部都要計入成本。
Tech NewsSpaceX AI 收入急升,賣算力生意成形但離雲端巨頭仲有段路
SpaceX 第二季 AI 收入按年升 247%,外售運算容量係主要動力。不過,呢筆收入仲混合咗廣告、Grok 訂閱、API 同數據授權;要判斷呢盤生意可唔可以持續,就要再睇巨額資本開支、客戶集中同合約退出條款。
Tech NewsSpaceX 拉 Vera Rubin 上太空:AI data center 散熱同成本點計
SpaceX 搵 NVIDIA 合作設計 Starmind AI1 運算 payload,打算由 2027 年起試放原型衛星。太空太陽能有吸引力,不過散熱、通訊、輻射、維修同發射成本,全部都未有規模化答案。
3C 產品Jellyfin 轉碼唔順唔好急住換機:先查 codec、client 同 GPU
Jellyfin 外出串流窒下窒下,好多人第一時間諗住換 CPU。其實轉碼負載由檔案格式、播放裝置、字幕同 HDR 一齊決定,現有 Intel iGPU 隨時已經幫到手;就算真係要買 GPU,都要先查清楚解碼同編碼支援。
Tech NewsReflection AI 租 SpaceX GB300:open-weight 模型都要燒天價 GPU
Reflection AI 據報會由 2026 年 7 月 1 日起,每月付 1.5 億美元租用 SpaceX Colossus 2 嘅 GB300 算力。呢單最值得睇嘅位,係開放權重模型背後一樣要靠超巨型 GPU 供應。
Tech NewsNvidia 液冷話慳到水,但 AI data center 水耗要睇埋電廠
Nvidia 話 Rubin 世代嘅 AI server 可以用 45°C 閉路液冷,喺合適氣候下 data center 冷卻用水近乎歸零。呢個工程方向有用,但 AI 水耗唔止喺機房入面,發電同晶片供應鏈都要一齊睇。
3C 產品Kimi K3 公開 2.8T 權重都難放入屋:MoE 慳運算,冇幫你縮細模型
Kimi K3 公開權重後,模型檔案任人下載,不過 2.8T 參數仍然令一般電腦食唔消。MoE 只係減少每次推理嘅運算量,完整權重照樣要擺入儲存同記憶體。一般開發者實際會用 API,成本、資料處理條款同 coding agent 效率先值得細睇。
Tech News3.6 萬個 IPMI 介面公開上網:公司同 homelab 有 iDRAC、iLO 要即刻查咩
Lava 話全球有 36,872 個 IPMI 介面直接連住公網,當中 24,650 個會喺登入前交出同密碼有關嘅驗證資料。問題源自舊 IPMI 設計,GPU 就大幅縮短猜密碼時間。公司 IT、機房同 homelab 管理員而家要先查公開面、換密碼、隔離管理網段同更新 BMC 韌體。
Tech NewsOpenAI 首粒 Jalapeño 晶片曝光:ChatGPT 成本戰入到硬件層
OpenAI 同 Broadcom 公開首粒由 OpenAI 自己設計嘅 AI 加速器 Jalapeño,主攻 ChatGPT、Codex 同 API 背後嘅 inference 工作。官方話每瓦表現好過而家主流方案,但完整數字未出,真正影響要睇部署規模同 API 價格有冇跟住郁。
Tech NewsSSI 冇公開產品照獲 NVIDIA 投資:傳聞 50 億美元買到咩?
NVIDIA 正式確認投資 Ilya Sutskever 創辦嘅 SSI,合作會將呢間神秘 AI 公司嘅算力提高約十倍。至於盛傳嘅 50 億美元,只來自路透知情人士,官方冇公開銀碼。呢單交易值得睇嘅,仲有 NVIDIA 點樣提早綁實下一輪前沿模型研究。
Tech NewsSSI 出關押注 Vera Rubin:Nvidia 提早押注 Ilya 嘅研究
匿埋研究兩年,Ilya Sutskever 嘅 SSI 終於同 Nvidia 簽長期合作,用 Vera Rubin 擴大算力。呢宗交易亦反映 SSI 開始由 Google TPU 擴展至 Nvidia GPU,不過所有技術突破暫時仍得公司自己講,外界連模型影都未見到。
Tech News輝達傳為 OpenAI 2,500 億美元融資作擔保,GPU 成本另計
輝達據報正洽談為 OpenAI 嘅俄亥俄州資料中心提供約 2,500 億美元融資後盾。呢筆錢唔會直接交畀 OpenAI,主要作用係幫項目借平啲、借多啲;不過晶片供應商同時支持客戶融資,亦會將 AI 產業嘅需求、信用同供應鏈風險綁得更緊。
Tech NewsAI agent 愈做愈多嘢,AMD 點解話 server CPU 增速快過 GPU
AMD 話 AI 運算開始由訓練轉向推論,會規劃任務、調用工具嘅 AI agent,又令 CPU 工作量急升。不過「增速快過 GPU」講緊市場規模預測,唔代表 CPU 收入或者出貨已經反超。真正值得開發團隊留意嘅,係部署 AI 時要計埋協調、資料庫、API 同 sandbox 成本。
Tech NewsAMD 用 MI455X、EPYC 同 Helios 機架正面追 Nvidia
AMD 推出 MI455X 加速器、EPYC 9006 server CPU 同 Helios 機架方案,目標係由晶片一路追到整套 AI 基建。規格睇落搶眼,但「2nm GPU」只講中部分事實;實際表現仲要睇互連、ROCm 軟件同雲端部署。
Tech NewsAMD Helios 正式埋位:用開放網絡同 ROCm 拆 NVIDIA AI 工廠圍牆
AMD 今次用 MI455X、Helios、ROCm 同開放式網絡砌出完整 AI 機架方案,正面挑戰 NVIDIA 全套生態。硬件數字確實進取,不過成本優勢暫時主要來自 AMD 自家模型推算,真正勝負要等 Azure 等雲端服務開價同獨立測試。
Tech NewsAMD Helios 72 GPU 機櫃出場:Azure 採用,ROCm 仲要證明自己
AMD 用 MI455X、72 GPU Helios 機櫃同 ROCm,正面挑戰 NVIDIA 全套 AI 基建。Microsoft Azure 同 Anthropic 已經承諾採用,證明市場想要多個算力來源;不過官方效能數字未有獨立測試,雲端價錢同供應地區亦未公布。
Tech NewsAMD Helios 規格正式落實:72 張 MI455X 點樣挑戰 Nvidia AI 機櫃
AMD 公開 Helios 完整規格,將 72 張 MI455X、EPYC Venice、Pensando 網絡同 ROCm 塞入一套機櫃級 AI 系統,2026 下半年開始出貨。紙面數字夠進取,但成本優勢仲要等客戶部署同獨立測試證明。
3C 產品Geekbench 7 跑分大改:新舊分數點解唔可以直接比較,買機又要睇啲咩
Geekbench 7 加入 Whisper、AV1、遊戲物理同 AI 工作負載,多核心測試亦改跟軟件實際用核心嘅方式。改動令跑分貼近近年用途,但 Geekbench 6 同 7 已經係兩把唔同嘅尺,買機時直接比較兩代總分只會得出錯誤結論。
3C 產品Geekbench 7 跑分重新洗牌:新分數點解唔可以同第 6 代硬碰
Geekbench 7 重做多核心同 GPU 測試,加入視像會議、AV1、Whisper 語音辨識、圖片處理同遊戲物理等工作。新內容確實貼近近年軟件用法,不過測試方法同基準機都轉咗,任何 Geekbench 6 對 Geekbench 7 嘅升跌百分比都冇意思。