Meta 用 Gemini 遇限流:AI coding 工具點解要有後備方案
Tech News

Meta 用 Gemini 遇限流:AI coding 工具點解要有後備方案

圖片:via Engadget — https://www.engadget.com/2203579/google-reportedly-capped-meta-use-of-gemini-ai-for-coding-chatbots/
TechLab 編輯部(譯)·

FT 指 Google 容量唔夠分,Meta 要叫員工慳 token

發生咩事

據 FT 報道,Google 大約喺今年 3 月通知 Meta,Gemini 容量供唔到 Meta 想買嘅量,所以要限制佢哋嘅用量。Reuters 轉述時亦講明,佢哋未能即時核實呢份報道,Google 同 Meta 喺截稿前都冇即時回應。呢單新聞要先當匿名消息睇,但最值得留意嘅位好實際:連 Meta 呢種級數嘅公司,用 AI 都會撞到算力同 token 配額上限。

Gemini Code Assist 喺深色程式碼編輯器入面顯示 coding 建議嘅官方示意圖

圖片:Google

Meta 用 Gemini 做咩

Engadget 根據 FT 報道整理,Meta 用 Gemini 喺客服、廣告 chatbot、coding、有害內容下架同詐騙偵測上面。FT 消息人士話,Meta 最初揀 Gemini,因為有啲任務 Gemini 做得好過自家 Llama,同時亦用 Anthropic Claude 做類似用途。Meta 官方 2025 年 11 月話會喺美國到 2028 年前投入逾 6,000 億美元撐 AI、基建同人手,投資咁大,短期仍要買對手模型嘅容量,呢點幾值得玩味。

Meta 官方文章用嘅資料中心投資示意圖

圖片:Meta

點解容量會咁緊

Google 自己嘅數字都解釋到點解會咁緊。Alphabet Q1 2026 earnings call 入面,Sundar Pichai 話 Google Cloud 首次過 200 億美元季度收入,backlog 過 4,600 億美元,客戶直接 API 每分鐘處理逾 160 億 token。Google Gemini API 文件亦寫明,rate limit 會按 RPM、TPM、RPD 去計,實際容量會變。即係你有錢買雲端服務,都唔代表尖峰時段一定攞到你想要嗰條水喉。

開發團隊點解要驚

startup、agency、IT team、內容團隊如果已經喺內部流程接入 Gemini API 或 AI coding 工具,呢單要睇成供應風險。唔好只問邊個模型答得最叻,要問限流時點降級、邊啲任務可以排隊、邊啲任務轉用 Flash 或細模型、邊啲先保留 Pro、Claude、GPT 等級模型。token 都要當成本中心管理,尤其 coding agent 一個 prompt 可能拆成好多次模型請求,唔知用量去向,好快就會月底先發現爆錶。

太靠單一模型,出事成本好高

429 error 只係最易見到嗰一下。當客服、廣告審核、程式碼生成同安全偵測都食同一個外部模型,供應商一收緊,你受影響嘅可能係幾個部門一齊慢。比較貼地嘅做法係預早做 model routing:平日用主力模型,低風險摘要、分類、草稿交畀細模型;高風險內容要有人覆核;核心服務要有第二個模型或自家模型頂住,仲要定期跑 eval,唔好等出事先臨急轉 provider。

下一步睇咩

FT 話限制暫時仍生效,亦有其他 Google 客戶受影響但程度細過 Meta;呢兩點要等官方或客戶側放多啲資料。短期睇,Google 要證明 Gemini Enterprise 同 Code Assist 供應唔會拖慢大客部署,Meta 要證明 Llama 或內部模型追得上外部模型。其他公司引入 AI 工具時,採購表入面最好加一欄:限流、備援、token budget,同資料可唔可以安全咁喺多個模型之間走。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook