TAG
#MoE
3 篇文章
TechLab 所有關於「MoE」嘅文章、評測同教學,由最新排起。
Tech NewsCursor 為 Composer 改造 MoE 訓練:MoK 點樣拆走跨 GPU 樽頸
Cursor 開源 MoE 訓練 megakernel「MoK」,將跨 GPU 傳送 token 同專家運算放入同一個核心。官方話 Composer 訓練吞吐量升咗 41%,不過呢個係大型 Blackwell 叢集嘅內部結果,同 Cursor 寫 code 快唔快係兩回事。
1 個月前
Tech NewsKimi K3 用 2.8T MoE 追 Claude、GPT:coding 強,自己部署仲要等
Moonshot AI 推出 Kimi K3,主打 2.8T MoE、100 萬 token context 同長時間 coding agent。官方測試話表現貼近 Claude Fable 5 同 GPT-5.6 Sol,不過獨立測試見到速度、成本各有取捨,完整權重亦要等到 7 月 27 日。
2 個月前
3C 產品1.5TB 大模型用 25GB RAM 跑到,Colibrì 其實證明咗咩?
Colibrì 用 25GB RAM 跑 GLM-5.2 好吸睛,但唔等於平機打贏 AI server;值得睇嘅係 MoE 點樣將 VRAM 壓力搬去 NVMe、RAM cache 同 CPU。
2 個月前