Google 發布三款 Gemini Flash 新模型,聚焦效率與成本優化
分類: AI 新品報導 發布時間:
Google於7月21日同步推出三款新一代Gemini模型,包括主打效率的Gemini 3.6 Flash、高速低成本的Gemini 3.5 Flash-Lite,以及專攻資安的Gemini 3.5 Flash Cyber。這波更新並非旗艦級突破,而是聚焦在讓人工智慧代理人(AI agents)更容易大規模部署,同時降低使用成本。
根據Google官方說明,Gemini 3.6 Flash定位為「工作馬」模型,在程式碼生成、知識工作與多模態理解上皆有提升。相較前代Gemini 3.5 Flash,它在Artificial Analysis指數上減少約17%的輸出token用量,部分長程軟體工程基準測試(如DeepSWE)甚至可減少高達65%的token消耗。這代表開發者在完成相同任務時,能以更少的計算資源與更低的費用達成目標。定價方面,輸入為每百萬token 1.5美元,輸出降至每百萬token 7.5美元,比前代更便宜。

在基準測試表現上,Gemini 3.6 Flash於DeepSWE軟體工程任務從37%提升至49%,機器學習研究基準MLE Bench從49.7%進步到63.9%,電腦操作能力(OSWorld-Verified)也從78.4%提高到83%。模型同時強化了內建的「電腦使用」工具,讓代理人能更精準地執行多步驟工作流程,並減少不必要的程式碼修改與迴圈。
另外兩款模型各有定位。Gemini 3.5 Flash-Lite主打速度與高吞吐量,每秒可輸出350個token,適合大量文件處理、代理人搜尋等低延遲場景,定價僅需輸入每百萬token 0.3美元、輸出2.5美元。至於Gemini 3.5 Flash Cyber則專為找出並修復資安漏洞而微調,目前僅限政府與信任合作夥伴透過CodeMender代理人系統試用。
Google也同步透露,延遲已久的Gemini 3.5 Pro仍在與合作夥伴測試中,預計就緒後就會全面開放;更下一代的Gemini 4則已展開「史上最雄心勃勃」的預訓練工作。這顯示Google在旗艦模型尚未到位前,先以效率與成本優勢鞏固開發者生態。
目前Gemini 3.6 Flash與3.5 Flash-Lite已全面上線,使用者可在模型選單中直接切換體驗。
Google官方部落格(查證日期:2026/07/22)
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/


