Gemini 新 Flash 點揀?3.6 做複雜 agent,3.5 Lite 跑大量工作
Tech News

Gemini 新 Flash 點揀?3.6 做複雜 agent,3.5 Lite 跑大量工作

圖片:via TechNews 科技新報 — https://technews.tw/2026/07/22/google-introduces-gemini-3-6-flash-gemini-3-5-flash-lite-and-gemini-3-5-flash-cyber/
TechLab 編輯部(譯)·

兩款 GA 模型價錢差幾倍,遷移仲有 API 改動要執

Google 7 月 21 日公布 Gemini 3.6 Flash、3.5 Flash-Lite 同 3.5 Flash Cyber。TechNews 科技新報報道亦提到,Gemini 3.5 Pro 仲喺合作夥伴測試階段。對一般開發者嚟講,而家真正有得揀嘅係頭兩款:兩者都已經 GA,可以經 Gemini API 同 Google AI Studio 使用,但適合嘅工作量差幾遠。

3.6 Flash:複雜 agent 唔使再硬上 Pro

Gemini 3.6 Flash 每 100 萬個輸入 token 收 1.50 美元,輸出就係 7.50 美元;輸入價同 3.5 Flash一樣,輸出平咗約 16.7%。Google 引述 Artificial Analysis Index,話新模型完成相同評測時少用 17% 輸出 token。假設呢個比例喺你套工作同樣成立,兩項節省疊埋,單計輸出部分理論上可以平約 31%。不過實際帳單仲會受 prompt 長度、thinking level、cache 命中率同工具呼叫次數影響,正式轉用前始終要用自己嘅 trace 計一次。

能力方面,Google 公布嘅 DeepSWE 成績由 3.5 Flash 嘅 37% 升到 49%,MLE Bench 就由 49.7% 升到 63.9%;呢啲全部係官方列出嘅 benchmark,唔係 TechLab 實測。官方亦話 3.6 Flash 會少啲亂改程式碼,同埋減少 agent 反覆執行同一段流程。寫 code、分析圖表、操作工具或者跑多步 agent,都係佢較合理嘅位置。

Gemini 3.6 Flash、3.5 Flash-Lite 同 3.5 Flash Cyber 官方發布主視覺

圖片:Google

3.5 Flash-Lite:大量簡單工作先最抵

3.5 Flash-Lite 每 100 萬個輸入 token 只收 0.30 美元,輸出係 2.50 美元,分別係 3.6 Flash 嘅五分一同三分一。Google 引述 Artificial Analysis,指模型速度達每秒 350 個輸出 token。呢種規格最啱客服分類、收據整理、文件抽取、翻譯、搜尋子任務同結構化 JSON;單次差額要睇每次用幾多 token;如果同一套流程每日跑幾十萬次,累積成本就可能拉開。

Flash-Lite 預設用 minimal thinking level,目的係壓低延遲同 token 用量。要佢自己規劃多步工作、執行程式碼或者連續呼叫工具,就可以改用 mediumhigh。不過 thinking 開得愈高,速度同成本優勢亦可能縮細。大量簡單任務先交畀 Lite,較難嘅個案再轉去 3.6 Flash,通常會易控制過全站只用一款模型。

功能表相近,分流方法先影響成本

兩款模型都有約 100 萬 token context、最多約 6.4 萬個輸出 token,支援文字、圖片、影片、聲音同 PDF 輸入,亦有 structured output、function calling、code execution 同仍屬 Preview 嘅 Computer Use。功能表睇落相當接近,實際分界落喺每單工作行幾耐、用幾多 token,同埋失敗後要重試幾多次。可以用 3.6 Flash 做主 agent,再畀 Flash-Lite 處理抽取、分類同其他大量子任務,呢種兩級分流亦符合 Google 展示新模型時嘅用法。

換模型 ID 之前,先執走舊 API 寫法

升級唔可以淨係將 model ID 換成 gemini-3.6-flashgemini-3.5-flash-lite。Google 最新遷移文件寫明,temperaturetop_ptop_k 已經標成棄用,新模型會忽略佢哋,之後嘅版本更可能直接回傳錯誤;thinking_budget 亦要改用 thinking_level。舊有 prefilled model turn 寫法同樣唔再支援,如果 request 最後一個有效 turn 係 model,API 會回傳 400。上正式環境前,最好用 shadow traffic 比較輸出格式、工具成功率、延遲同每單成本。

Flash Cyber 唔係一般 API 新選項

3.5 Flash Cyber 係建基於 3.5 Flash、專門搵同修補程式碼漏洞嘅版本,會配合 Google CodeMender,用多個 agent 分工後整合報告。資訊保安模型既可以用嚟防守,亦可能俾人用嚟攻擊,所以 Google 只打算先向政府同可信合作夥伴提供受控試用,而且公布時仍然係「即將」推出。一般公司暫時唔可以喺 AI Studio 個模型清單揀佢,亦唔應該當成 3.6 Flash 嘅安全加強版。

3.5 Pro 仲未有足夠資料比較

Google 只確認 Gemini 3.5 Pro 正同合作夥伴測試,準備好之後先會擴大供應,暫時冇公布 API 定價、正式日期或者完整效能資料。開發者而家規劃系統,應以已經 GA 嘅 3.6 Flash 同 3.5 Flash-Lite 做基準;等 Pro 有正式規格,再睇佢值唔值得接手最難、容錯率最低嗰批工作。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook