Google Gemini 3.6 Flash 減價兼慳 token,agent 成本點計先啱
3C 產品

Google Gemini 3.6 Flash 減價兼慳 token,agent 成本點計先啱

圖片:via Android Authority — https://www.androidauthority.com/google-launches-gemini-36-flash-3689795/
TechLab 編輯部(譯)·

輸出單價同 token 用量一齊跌,香港開發者仲要留意地區限制

Google 推出 Gemini 3.6 Flash,表面睇只係 3.5 Flash 面世兩個月後嘅小更新,但今次最值得開發者計清楚嘅,其實係張單。新模型主打 coding、知識工作、多模態同 agent 任務,官方話佢會少行一啲 reasoning step、少叫幾次工具,生成內容亦冇咁長氣。對每日跑幾十萬次任務嘅產品,呢啲改動實際過跑分升幾點好多。

單價平 16.7%,token 用量再跌 17%

Google 官方定價,3.6 Flash 嘅 input 價維持每百萬 token 1.50 美元,output 就由 3.5 Flash 嘅 9 美元減到 7.50 美元,單計 output 單價平咗 16.7%。Google 再引述 Artificial Analysis Index,話 3.6 Flash 完成同一組測試時少用 17% output token;呢個數字來自第三方測試同 Google 整理,唔係 TechLab 實測,亦唔代表每種工作都會慳足 17%。

兩層減幅疊埋先見到 agent 嘅真正分別。假設舊模型一批工作生成一億 output token,3.5 Flash 收 900 美元;若新模型真係只用 8,300 萬 token,按新價就係 622.50 美元,output 部分平約 30.8%。不過完整帳單仲有 input、搜尋、工具 API、重試同儲存成本,所以唔可以直接話所有 agent 都平三成。Google 話工具呼叫同執行循環亦減少,但未公布一個適用於所有 workflow 嘅百分比。

Google Gemini 3.6 Flash、3.5 Flash-Lite 同 Flash Cyber 官方主視覺

圖片:Google

Agent 成本最怕長氣同反覆兜圈

傳統 chatbot 答完一段文字就停,agent 就可能先讀文件、搵資料、寫 code、執行、睇錯誤,再返去修改。每兜一圈,舊有對話、工具結果同新 reasoning 都可能再入 context,output 亦會成為下一輪 input。3.6 Flash 若真係少改錯 code、少跑冤枉循環,慳到嘅會多過最後答案短咗幾行;不過團隊仍然要用自己嘅 prompt、工具同任務重跑評估,尤其要比較成功率、重試次數同每個成功任務成本。

Google 公布嘅 benchmark 顯示,3.6 Flash 喺 DeepSWE 得分由 3.5 Flash 嘅 37% 升到 49%,OSWorld-Verified 就由 78.4% 升到 83%。呢啲全部係供應商公布數據,適合用嚟決定值唔值得開 A/B test,未足以代替 production traffic。特別係 coding agent,少改一個唔應該郁嘅檔案,價值可能高過慳幾千 token。

Gemini 3.5 Flash Cyber 配上藍色盾牌嘅官方圖片

圖片:Google DeepMind

AI Studio、Android Studio 同香港帳戶點計

Google 話 3.6 Flash 已用穩定型號 gemini-3.6-flash 上架,開發者可喺 Gemini API、AI Studio、Android Studio 同 Antigravity 使用;一般用戶亦可喺 Gemini app 用到,企業就有 Gemini Enterprise Agent Platform 同 Gemini Enterprise app。3.5 Flash-Lite 同日開放,定位係大量翻譯、文件處理同較簡單嘅 agent 子任務,收費為每百萬 input 0.30 美元、output 2.50 美元。

香港情況要分開睇。Google 嘅 mobile app 支援頁已列出香港,但AI Studio 同 Gemini Developer API 地區名單截至截稿時仍然冇香港,頁面建議名單以外地區改用企業平台。換句話講,香港一般帳戶可以用 Gemini app,但唔應假設可以直接申請 AI Studio API key;Android Studio 同 Antigravity 會唔會受同一帳戶地區限制,Google亦冇另列香港 rollout 說明。公司要正式部署,現階段應先核實企業平台、帳單地區同資料處理條款。

Flash Cyber 搵到漏洞,Google亦唔敢全面開放

今次另一個型號 Gemini 3.5 Flash Cyber 專門配合 CodeMender 搵、驗證同修補漏洞。Google DeepMind 話,模型喺固定呼叫次數下,喺 V8 JavaScript 引擎搵到 55 個確認問題,多過普通 3.5 Flash 嘅 47 個同 Claude Opus 4.6 嘅 36 個。;Google亦聲稱佢曾生成可以避過常見防護嘅可靠 remote-code execution exploit。數據都係 Google 自己測試,但已經解釋到點解呢款模型暫時只畀政府同可信合作夥伴試用。

呢種能力既可以用嚟防守,亦可以用嚟攻擊,所以 Google 暫時唔全面開放亦算合理;往後攻守兩邊都可能用輕量模型擴大掃描規模。:輕量模型可以平價開大量 sub-agent,掃更多 code path,攻守兩邊都會用同一套規模優勢。至於 Gemini 3.5 Pro,Google只話仍同合作夥伴測試,準備好後先廣泛推出;Gemini 4 就啱啱開始 pre-training,兩款都未有確實日期。現階段開發團隊最實際嘅下一步,係先用自己嘅 agent 任務比較 3.6 Flash 每個成功結果到底慳幾多。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook