Google 於 7 月 21 日宣布推出三款全新 Gemini Flash 系列模型,包括 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 以及專注網路安全的 Gemini 3.5 Flash Cyber。這些模型延續 Flash 系列「高效能、低延遲」的定位,針對開發者建構生產級 AI Agent 提供更優化的 token 效率、速度與成本控制,同時推動多模態與代理式工作流程的實際應用。
Gemini 3.6 Flash:更高效的主力模型
Gemini 3.6 Flash 是本次重點更新,被定位為主力模型,建基於 3.5 Flash 的開發者反饋,在編碼、知識工作及多模態任務上均有提升。根據 Artificial Analysis Index,它比 3.5 Flash 減少約 17% 的輸出 token 使用量,在 DeepSWE 等基準測試中最高可達 65% 改善,同時減少不必要的程式碼編輯與執行迴圈。
主要性能提升包括:
- DeepSWE:49% vs 3.5 Flash 的 37%
- MLE-Bench:63.9% vs 49.7%
- OSWorld-Verified(電腦使用):83.0% vs 78.4%
- GDPval-AA v2:1421 vs 1349

定價方面,3.6 Flash 輸入 US$1.50/百萬 token,輸出 US$7.50/百萬 token,比前代更具成本效益,適合複雜代理工作流程。模型支援文字、圖像、影片及音頻,已在 Google AI Studio、Gemini API 及企業平台全面開放。
Google 強調,3.6 Flash 在多代理協作下,能更快速處理文件解析、財務數據分析及程式碼遷移等任務。
Gemini 3.5 Flash-Lite:極速低成本的高吞吐選擇
Gemini 3.5 Flash-Lite 針對高吞吐量、低延遲場景優化,是 3.5 系列中最快、最具性價比的模型。Artificial Analysis 顯示其輸出速度高達 350 tokens/s,適合文件處理、代理搜尋及子代理任務。
定價僅輸入 US$0.30/百萬 token、輸出 US$2.50/百萬 token,遠低於主流模型。相較前代,它在 Terminal-Bench 2.1、GDM-MRCR v2 及 GDPval-AA v2 等基準上大幅領先,甚至在多項代理及編碼任務上超越舊版 3 Flash,支援可調整思考層級以平衡速度與智能。

這款模型特別適合大規模生產環境,例如批量收據翻譯、電子商務數據提取及即時生成多個網頁設計概念,幫助開發者以低成本擴展 agentic 工作流。
Gemini 3.5 Flash Cyber:專攻漏洞偵測與修復
Gemini 3.5 Flash Cyber 是基於 3.5 Flash 微調的輕量級網路安全模型,搭配 CodeMender 代理,能高效找出、驗證並修補軟體漏洞。在 CyberGym 基準中,透過多代理呼叫達到前沿水準;在 Google 內部測試(如 Chrome 提交掃描)中,亦大幅優於主流 Flash 模型,並發現更多獨特漏洞。

由於雙重用途考量,3.5 Flash Cyber 目前限政府及信任夥伴透過 CodeMender 試點使用,未來將逐步擴展。Google 表示,這有助防禦者更快應對威脅,同時在 Chrome、Android 等內部代碼庫已實際應用。
Gemini 3.5 Pro 即將推出
Google 同時透露 Gemini 3.5 Pro 即將推出,並已展開 Gemini 4 的預訓練工作。新 Flash 模型強化了安全防護,特別在 CBRN 及網路攻擊領域,並降低有益用途的拒絕率。



