
Gemini 3.6 Flash 減價頂住檔:三款新模型點揀,3.5 Pro 去咗邊?
Google 先執平價模型同 agent 成本,旗艦 Pro 仍然未有日期
Google 今次一口氣交出三款 Gemini,但一般開發者真正揀得到嘅,其實得兩款:3.6 Flash 負責較複雜嘅 coding 同 agent 工作,3.5 Flash-Lite 就主攻大量、重複、講求反應速度嘅任務。Flash Cyber 聽落搶眼,不過佢只會經 CodeMender 畀政府同獲准合作夥伴試用,普通帳戶暫時掂唔到。
3.6 Flash:慳錢靠兩邊一齊減
Gemini 3.6 Flash 可以當成 Google 而家嘅主力工作馬。標準 API 每百萬 input token 收 1.50 美元,output token 收 7.50 美元;上代 3.5 Flash 分別係 1.50 同 9 美元。Google 又話,新版喺 Artificial Analysis Index 用少最多 17% output token,處理多步工作時亦少啲推理步驟同工具呼叫。output token 個價由 9 美元減到 7.50 美元,Google 又話新版喺 Artificial Analysis Index 最多慳 17% output token。,對會連續呼叫模型十幾次嘅 agent,兩筆數會一齊反映喺帳單。
效能數字就要睇清楚來源:coding、知識工作、多模態同 computer use 嘅提升,都係 Google 自家公佈嘅 benchmark,TechLab 未有獨立測試。開發者唔應該淨係望總分,反而要用自己個 repo 測 unwanted edits、失敗重試次數同完成一個 issue 要幾多輪。agent 最燒錢嗰部分,往往係模型兜圈同反覆改錯檔,實際用落,少重跑一次,可能仲緊要過 benchmark 高幾個百分點。

圖片:Google
Flash-Lite 平,但唔係 Gemini 入面最平
3.5 Flash-Lite 標準價係每百萬 input token 0.30 美元、output token 2.50 美元,官方定位係大量 agent、翻譯同簡單資料處理。Google 又話速度接近每秒 350 個 output token,呢個數同其他效能比較同樣來自官方。客服分類、抽欄位、摘要、簡單 routing 呢類量大但推理唔深嘅工作,可以先由佢跑;撞到複雜 code 或長流程先升上 3.6 Flash。
不過「最具成本效益」呢句 marketing 要拆開睇。仍然有正式版供應嘅 3.1 Flash-Lite,只收 0.25 美元 input 同 1.50 美元 output,純計 token 帳單平過新版。3.5 Flash-Lite 買到嘅係較新能力同速度,唔代表任何 workload 都會平。最穩陣嘅揀法係抽一批真實任務,計埋成功率、重試同延遲後嘅每宗完成成本,唔好只比較價目表第一行。

圖片:Google
Flash Cyber 暫時唔關一般 API 用家事
3.5 Flash Cyber 由 3.5 Flash 微調而成,用嚟搵、驗證同修補軟件漏洞。Google 解釋,CodeMender 會叫多個 Flash Cyber sub-agent 掃唔同 code path,再合成報告;輕量模型喺呢類要大量探索嘅工作,成本優勢先容易發揮。官方測試話佢喺 V8 搵到 55 個確認問題,3.5 Flash 同 Claude Opus 4.6 分別係 47 同 36 個,不過測試由 Google設計,對手成績亦有部分來自供應商自行申報。
呢款模型有明顯 dual-use 風險,搵漏洞同寫 exploit 只差幾步,所以 Google 會先放入 limited-access pilot,經 CodeMender 畀政府同 trusted partners 使用,亦未公佈一般 Gemini API 價錢。公司想做 code security,可以留意 Google 另行放入 Gemini Enterprise Agent Platform 嘅 CodeMender 基礎能力;暫時唔好將 Flash Cyber 寫入普通產品 roadmap。
3.5 Pro 再遲,coding agent 唔好押注單一型號
Google 五月曾講 3.5 Pro 已經內部使用,期望六月推出,但到七月仍然只話正同合作夥伴測試,會喺準備好之後推出。Bloomberg 報道指模型未達內部效能目標;Google未有完整公開延遲原因,所以暫時冇足夠資料再推斷。更微妙嘅係,Google 同時話 Gemini 4 已開始公司歷來最進取嘅 pre-training run,產品線短期內仍可能快速轉動。
做 coding agent 嘅團隊可以照用 3.6 Flash 跑日常改 code、工具呼叫同大量任務,複雜推理就保留現有 Pro 或其他供應商做 fallback。模型層最好留返 routing、評測同替換空間,避免將 prompt、工具格式同重試邏輯綁死落一個未發布型號。3.5 Pro 幾時出仍值得睇,但而家部署策略應該按已交付嘅 API、實際成功率同成本決定。
香港帳戶可用性未有官方確認
Google 官方價目頁已經列出 3.6 Flash 同 3.5 Flash-Lite,亦提供 AI Studio 試用連結;不過截至發布時,Google AI Studio 同 Gemini Developer API 嘅官方支援地區名單冇列出香港。嗰份名單唔係逐款模型拆分,而且最後更新日期早過今次發布,所以只能確認官方未有文件支持「香港帳戶可直接使用」。經其他地區帳戶、企業平台或雲端服務可唔可以用,要按各自合約同 console 實際顯示再核實。
參考來源
- TechCrunch — Google releases three new Gemini models — but no 3.5 Pro — original report
- Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber — Google 官方發布文,核實模型定位、效能聲稱同推出範圍
- Gemini Developer API pricing — 核實 3.6 Flash、3.5 Flash-Lite、3.5 Flash 同 3.1 Flash-Lite 定價
- Introducing Gemini 3.5 Flash Cyber — 核實 Flash Cyber 測試、CodeMender 架構同 limited-access pilot 限制
- Available regions for Google AI Studio and Gemini API — 核實官方支援地區名單暫時冇列出香港
- Google Gemini Launch Delayed as Tech Falls Short of Internal Goals — 3.5 Pro 未達內部效能目標嘅報道來源
本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。







