TAG

#GPU

42 篇文章

TechLab 所有關於「GPU」嘅文章、評測同教學,由最新排起。

Nvidia 手上 1.23 億股 SpaceX,來源線索指向 xAI 換股Tech News

Nvidia 手上 1.23 億股 SpaceX,來源線索指向 xAI 換股

Nvidia 季末持有約 1.23 億股 SpaceX,申報價值接近 210 億美元。股份好大機會來自早年投資 xAI 後換股,不過公開文件未足以還原全部交易。持股令雙方利益靠近,但 SpaceX 嘅 GPU 供應仍然主要靠逐張訂單,未見長期採購量保證。

7 天前
Kog 單一 kernel 推到 3,000 tokens/s:coding agent 點解最食延遲Tech News

Kog 單一 kernel 推到 3,000 tokens/s:coding agent 點解最食延遲

Kog 話自家推理引擎可喺 8 張 MI300X 上跑到每秒 3,000 個輸出 token。個數字夠搶眼,不過真正值得睇嘅係佢點樣壓低單一請求延遲,同埋呢套方法搬去大型第三方模型時會遇到咩限制。

8 天前
Nvidia 拉埋華爾街撐 AI 基建,5,000 億融資點樣放大 GPU 需求Tech News

Nvidia 拉埋華爾街撐 AI 基建,5,000 億融資點樣放大 GPU 需求

Nvidia 搵嚟六間金融巨頭,計劃為 AI 基建動員逾 5,000 億美元第三方資金。呢個安排可以降低客戶買 GPU 同起數據中心嘅門檻,亦會令供應商、投資者同客戶綁得更實。交易本身未等於假需求,不過算力收入一旦追唔上擴建速度,GPU 殘值、雲端價格同 Nvidia 估值都會受壓。

8 天前
傳 Nemotron 4 至少一萬億參數,輝達由賣 GPU 再攻模型層Tech News

傳 Nemotron 4 至少一萬億參數,輝達由賣 GPU 再攻模型層

NVIDIA 已確認 Nemotron 4 系列正在籌備,但一萬億參數同最快秋末完成仍然只係匿名消息。值得留意嘅係,輝達正由 GPU、CUDA 同雲端基建一路擴到模型層,想開發者由訓練到部署都用佢嗰套生態。

10 天前
AWS AgentCore 加入 Runtime Instances:AI agent 跑足幾日有代價Tech News

AWS AgentCore 加入 Runtime Instances:AI agent 跑足幾日有代價

AgentCore Runtime Instances 將 AI agent 搬到 AWS 代管嘅 EC2,工作階段上限由 8 小時拉長至 14 日,又支援 GPU、多 agent 共用檔案同停止後恢復。不過長達 14 日只係生命週期上限,開發者仍然要自己處理 checkpoint、重試、成本同資源爭用。

12 天前
AMD 簽協議擬收購 Taalas:AI 模型直接入晶片,快得有代價Tech News

AMD 簽協議擬收購 Taalas:AI 模型直接入晶片,快得有代價

AMD 想買入 Taalas 嘅固定模型晶片技術,避開 GPU 搬運模型權重嘅效率樽頸。不過 HC1 嘅高速數字來自廠方自測,模型更新、低精度量化同大晶片量產風險,全部都要計入成本。

15 天前
SpaceX AI 收入急升,賣算力生意成形但離雲端巨頭仲有段路Tech News

SpaceX AI 收入急升,賣算力生意成形但離雲端巨頭仲有段路

SpaceX 第二季 AI 收入按年升 247%,外售運算容量係主要動力。不過,呢筆收入仲混合咗廣告、Grok 訂閱、API 同數據授權;要判斷呢盤生意可唔可以持續,就要再睇巨額資本開支、客戶集中同合約退出條款。

17 天前
SpaceX 拉 Vera Rubin 上太空:AI data center 散熱同成本點計Tech News

SpaceX 拉 Vera Rubin 上太空:AI data center 散熱同成本點計

SpaceX 搵 NVIDIA 合作設計 Starmind AI1 運算 payload,打算由 2027 年起試放原型衛星。太空太陽能有吸引力,不過散熱、通訊、輻射、維修同發射成本,全部都未有規模化答案。

17 天前
Jellyfin 轉碼唔順唔好急住換機:先查 codec、client 同 GPU3C 產品

Jellyfin 轉碼唔順唔好急住換機:先查 codec、client 同 GPU

Jellyfin 外出串流窒下窒下,好多人第一時間諗住換 CPU。其實轉碼負載由檔案格式、播放裝置、字幕同 HDR 一齊決定,現有 Intel iGPU 隨時已經幫到手;就算真係要買 GPU,都要先查清楚解碼同編碼支援。

18 天前
Reflection AI 租 SpaceX GB300:open-weight 模型都要燒天價 GPUTech News

Reflection AI 租 SpaceX GB300:open-weight 模型都要燒天價 GPU

Reflection AI 據報會由 2026 年 7 月 1 日起,每月付 1.5 億美元租用 SpaceX Colossus 2 嘅 GB300 算力。呢單最值得睇嘅位,係開放權重模型背後一樣要靠超巨型 GPU 供應。

19 天前
Nvidia 液冷話慳到水,但 AI data center 水耗要睇埋電廠Tech News

Nvidia 液冷話慳到水,但 AI data center 水耗要睇埋電廠

Nvidia 話 Rubin 世代嘅 AI server 可以用 45°C 閉路液冷,喺合適氣候下 data center 冷卻用水近乎歸零。呢個工程方向有用,但 AI 水耗唔止喺機房入面,發電同晶片供應鏈都要一齊睇。

20 天前
Kimi K3 公開 2.8T 權重都難放入屋:MoE 慳運算,冇幫你縮細模型3C 產品

Kimi K3 公開 2.8T 權重都難放入屋:MoE 慳運算,冇幫你縮細模型

Kimi K3 公開權重後,模型檔案任人下載,不過 2.8T 參數仍然令一般電腦食唔消。MoE 只係減少每次推理嘅運算量,完整權重照樣要擺入儲存同記憶體。一般開發者實際會用 API,成本、資料處理條款同 coding agent 效率先值得細睇。

21 天前
3.6 萬個 IPMI 介面公開上網:公司同 homelab 有 iDRAC、iLO 要即刻查咩Tech News

3.6 萬個 IPMI 介面公開上網:公司同 homelab 有 iDRAC、iLO 要即刻查咩

Lava 話全球有 36,872 個 IPMI 介面直接連住公網,當中 24,650 個會喺登入前交出同密碼有關嘅驗證資料。問題源自舊 IPMI 設計,GPU 就大幅縮短猜密碼時間。公司 IT、機房同 homelab 管理員而家要先查公開面、換密碼、隔離管理網段同更新 BMC 韌體。

24 天前
OpenAI 首粒 Jalapeño 晶片曝光:ChatGPT 成本戰入到硬件層Tech News

OpenAI 首粒 Jalapeño 晶片曝光:ChatGPT 成本戰入到硬件層

OpenAI 同 Broadcom 公開首粒由 OpenAI 自己設計嘅 AI 加速器 Jalapeño,主攻 ChatGPT、Codex 同 API 背後嘅 inference 工作。官方話每瓦表現好過而家主流方案,但完整數字未出,真正影響要睇部署規模同 API 價格有冇跟住郁。

25 天前
SSI 冇公開產品照獲 NVIDIA 投資:傳聞 50 億美元買到咩?Tech News

SSI 冇公開產品照獲 NVIDIA 投資:傳聞 50 億美元買到咩?

NVIDIA 正式確認投資 Ilya Sutskever 創辦嘅 SSI,合作會將呢間神秘 AI 公司嘅算力提高約十倍。至於盛傳嘅 50 億美元,只來自路透知情人士,官方冇公開銀碼。呢單交易值得睇嘅,仲有 NVIDIA 點樣提早綁實下一輪前沿模型研究。

25 天前
SSI 出關押注 Vera Rubin:Nvidia 提早押注 Ilya 嘅研究Tech News

SSI 出關押注 Vera Rubin:Nvidia 提早押注 Ilya 嘅研究

匿埋研究兩年,Ilya Sutskever 嘅 SSI 終於同 Nvidia 簽長期合作,用 Vera Rubin 擴大算力。呢宗交易亦反映 SSI 開始由 Google TPU 擴展至 Nvidia GPU,不過所有技術突破暫時仍得公司自己講,外界連模型影都未見到。

26 天前
輝達傳為 OpenAI 2,500 億美元融資作擔保,GPU 成本另計Tech News

輝達傳為 OpenAI 2,500 億美元融資作擔保,GPU 成本另計

輝達據報正洽談為 OpenAI 嘅俄亥俄州資料中心提供約 2,500 億美元融資後盾。呢筆錢唔會直接交畀 OpenAI,主要作用係幫項目借平啲、借多啲;不過晶片供應商同時支持客戶融資,亦會將 AI 產業嘅需求、信用同供應鏈風險綁得更緊。

26 天前
AI agent 愈做愈多嘢,AMD 點解話 server CPU 增速快過 GPUTech News

AI agent 愈做愈多嘢,AMD 點解話 server CPU 增速快過 GPU

AMD 話 AI 運算開始由訓練轉向推論,會規劃任務、調用工具嘅 AI agent,又令 CPU 工作量急升。不過「增速快過 GPU」講緊市場規模預測,唔代表 CPU 收入或者出貨已經反超。真正值得開發團隊留意嘅,係部署 AI 時要計埋協調、資料庫、API 同 sandbox 成本。

29 天前
AMD 用 MI455X、EPYC 同 Helios 機架正面追 NvidiaTech News

AMD 用 MI455X、EPYC 同 Helios 機架正面追 Nvidia

AMD 推出 MI455X 加速器、EPYC 9006 server CPU 同 Helios 機架方案,目標係由晶片一路追到整套 AI 基建。規格睇落搶眼,但「2nm GPU」只講中部分事實;實際表現仲要睇互連、ROCm 軟件同雲端部署。

29 天前
AMD Helios 正式埋位:用開放網絡同 ROCm 拆 NVIDIA AI 工廠圍牆Tech News

AMD Helios 正式埋位:用開放網絡同 ROCm 拆 NVIDIA AI 工廠圍牆

AMD 今次用 MI455X、Helios、ROCm 同開放式網絡砌出完整 AI 機架方案,正面挑戰 NVIDIA 全套生態。硬件數字確實進取,不過成本優勢暫時主要來自 AMD 自家模型推算,真正勝負要等 Azure 等雲端服務開價同獨立測試。

30 天前
AMD Helios 72 GPU 機櫃出場:Azure 採用,ROCm 仲要證明自己Tech News

AMD Helios 72 GPU 機櫃出場:Azure 採用,ROCm 仲要證明自己

AMD 用 MI455X、72 GPU Helios 機櫃同 ROCm,正面挑戰 NVIDIA 全套 AI 基建。Microsoft Azure 同 Anthropic 已經承諾採用,證明市場想要多個算力來源;不過官方效能數字未有獨立測試,雲端價錢同供應地區亦未公布。

30 天前
AMD Helios 規格正式落實:72 張 MI455X 點樣挑戰 Nvidia AI 機櫃Tech News

AMD Helios 規格正式落實:72 張 MI455X 點樣挑戰 Nvidia AI 機櫃

AMD 公開 Helios 完整規格,將 72 張 MI455X、EPYC Venice、Pensando 網絡同 ROCm 塞入一套機櫃級 AI 系統,2026 下半年開始出貨。紙面數字夠進取,但成本優勢仲要等客戶部署同獨立測試證明。

30 天前
Geekbench 7 跑分大改:新舊分數點解唔可以直接比較,買機又要睇啲咩3C 產品

Geekbench 7 跑分大改:新舊分數點解唔可以直接比較,買機又要睇啲咩

Geekbench 7 加入 Whisper、AV1、遊戲物理同 AI 工作負載,多核心測試亦改跟軟件實際用核心嘅方式。改動令跑分貼近近年用途,但 Geekbench 6 同 7 已經係兩把唔同嘅尺,買機時直接比較兩代總分只會得出錯誤結論。

30 天前
Geekbench 7 跑分重新洗牌:新分數點解唔可以同第 6 代硬碰3C 產品

Geekbench 7 跑分重新洗牌:新分數點解唔可以同第 6 代硬碰

Geekbench 7 重做多核心同 GPU 測試,加入視像會議、AV1、Whisper 語音辨識、圖片處理同遊戲物理等工作。新內容確實貼近近年軟件用法,不過測試方法同基準機都轉咗,任何 Geekbench 6 對 Geekbench 7 嘅升跌百分比都冇意思。

30 天前