Gemini 3.6 Flash 推出:輸出價平 17%,同時慳 17% token
3C 產品

Gemini 3.6 Flash 推出:輸出價平 17%,同時慳 17% token

圖片:via 9to5Google — https://9to5google.com/2026/07/21/gemini-3-6-flash-launch/
TechLab 編輯部(譯)·

Google 主力減低成本同縮短執行迴圈,coding agent 最直接受惠

Google 正式推出 Gemini 3.6 Flash,今次更新最值得睇嘅地方幾實際:模型答得短咗、工具少兜圈,輸出 token 仲平咗。Gemini app 用家會直接用到,開發者就可以經 Gemini API、AI Studio、Android Studio 同 Google Antigravity 接入。Google 同時推出平價版 3.5 Flash-Lite,至於 Gemini 4,暫時只係確認已經開始預訓練,未有功能、價錢或者推出時間。

平 17% 之外,token 用量都少 17%

Gemini 3.6 Flash 嘅 API input 價維持每百萬 token US$1.50,output 就由 3.5 Flash 嘅 US$9 減到 US$7.50,即係單價平約 16.7%。Google 引用 Artificial Analysis Index 數據,話新模型完成同類任務時,output token 用量再少 17%。如果只計 output 部分,兩項效果疊加後,同一類任務嘅支出理論上可以低約 31%;實際總帳仲要睇 input、cache、搜尋同其他工具點收費,唔可以直接當成所有 API 帳單都平三成。

呢條數對普通問答未必好有感,但 coding agent 跑幾十個回合就差得遠。模型每輪產生嘅程式碼、推理內容同工具結果,下一輪好多時又會變成 input;少一截 output,之後連帶要重新讀取嘅內容都可能縮短。Google亦話 3.6 Flash 會用少啲推理步驟同工具呼叫完成多步任務。換句話講,慳到嘅唔止最後答案嗰幾行字,連中途反覆改檔、執行、睇錯誤再重試嘅成本都有機會一齊減。

Gemini 3.6 Flash、3.5 Flash-Lite 同 3.5 Flash Cyber 官方主視覺

圖片:Google

Coding agent 少亂改,實際價值高過跑分升幾格

效能數字全部來自 Google 公布或者指定 benchmark,唔係 TechLab 實測。DeepSWE 由 3.5 Flash 嘅 37% 升到 49%,MLE Bench 就由 49.7% 升到 63.9%。Google形容新模型會少啲無謂程式碼改動,執行迴圈亦會縮短。對開發者嚟講,呢點幾重要:agent 寫到一段可用程式碼之後,如果順手改壞旁邊幾個檔,跑分再高都只係增加收拾時間。

電腦操作方面,Google 公布 OSWorld-Verified 由 78.4% 升到 83%,computer use 亦成為 Gemini API 同 Gemini Enterprise 嘅內置工具。呢類任務要模型認畫面、撳介面、等結果再決定下一步,一個錯誤動作往往會拖出幾輪補救。3.6 Flash 如果真係可以少用工具、少重試,對瀏覽器自動化、資料輸入同軟件操作 agent 嘅改善,會實際過單純將文字答案生成快少少。不過未見獨立長時間測試前,穩定性仍然要逐個場景驗證。

Google官方比較 Gemini 3.6 Flash 效能嘅圖表

圖片:Google

3.5 Flash-Lite 主攻大量文件同搜尋任務

一齊推出嘅 Gemini 3.5 Flash-Lite 定價低好多,每百萬 input token US$0.30、output US$2.50。Google 引用 Artificial Analysis 數據,指佢可以做到每秒 350 個 output token,定位係 agentic search、文件處理、收據翻譯同大批資料抽取呢類高流量任務。佢喺 Terminal-Bench 2.1 得分由上代 31% 升到 54%,長內容測試 GDM-MRCR v2 就由 60.1% 升到 72.2%,但同樣屬官方列出嘅測試結果。

Flash-Lite 嘅取向幾清楚:公司如果每日要處理幾十萬頁文件、逐件商品抽欄位,未必想每次都叫較貴模型慢慢深思。3.5 Flash-Lite 可以按任務調低 thinking level,用較低成本同更快速度處理大量工作;遇上多步驟任務,先再加大推理力度。Google甚至話佢喺 SWE-Bench Pro 同 OSWorld-Verified 跑贏舊有 Gemini 3 Flash,反映細型平價模型已經足以接手一批以前要較高階模型做嘅自動化工作。

香港用到,但模型選單未必同步出現

Google官方話兩款模型由即日起供 Gemini app 用家使用,支援頁亦已經將香港列入 Gemini 網頁版同手機 app 地區;開發者可以經 Gemini API、AI Studio 同 Android Studio 使用,3.6 Flash 亦有 Antigravity。之不過,Google產品向來會分批更新,個別帳戶見到邊款模型、免費額度、語言功能同付費方案仍可能有差異,香港帳戶要以實際模型選單同官方方案頁為準。

至於 Gemini 4,Google只透露已經開始歷來最進取嘅預訓練,其他資料一概欠奉。眼前更值得睇嘅係 3.6 Flash 能否喺真實 agent 長時間運作下,持續做到少改錯檔、少重試同少食 token;如果獨立測試都對得上官方數字,呢次更新對開發成本嘅影響會大過版本號由 3.5 跳到 3.6。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook