Google 近期正式公開了一系列全新的 AI 模型更新,涵蓋了 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 以及專注於資安領域的 Gemini 3.5 Flash Cyber,同時透露了下一代模型 Gemini 4 的開發進度;這次發布主要著重於提升運算效率、降低成本,以及針對不同應用場景進行效能最佳化。

Gemini 3.6 Flash 效能與成本雙重優化
自 2026 年的 Google I/O 大會以來,Google 根據開發者與客戶的反饋推出了 Gemini 3.6 Flash,此版本的核心升級在於提高 Token 的處理效率。與前一代 Gemini 3.5 Flash 相比,新模型在處理多步驟工作流程時,能減少推理步驟與工具呼叫次數,使輸出 Token 的消耗量降低了 17%。
在定價方面,Gemini 3.6 Flash 的輸入價格為每百萬個 Token 1.50 美元,輸出價格則從原本的 9 美元大幅調降至 7.50 美元,在程式碼編寫表現上,新版本能減少多餘的程式碼編輯與執行迴圈,在 DeepSWE 與 MLE Bench 等基準測試中皆有顯著的數據成長。
此外,其知識庫的截止日期也正式推進至 2026 年 3 月,並在電腦使用能力測試 OSWorld-Verified 及知識工作測試 GDPval-AA 中獲得了更高的評分。
Gemini 3.5 Flash-Lite 鎖定高吞吐量任務
針對需要低延遲與高吞吐量的應用場景,例如代理搜尋與文件處理,Google 發表了 Gemini 3.5 Flash-Lite,這款模型的定價極具競爭力,輸入與輸出每百萬個 Token 分別僅需 0.30 美元與 2.50 美元;官方數據顯示,Gemini 3.5 Flash-Lite 在程式碼撰寫測試 Terminal-Bench 2.1、長文本處理測試 GDM-MRCR v2 以及真實世界任務執行測試 GDPval-AA v2 的表現中,不僅大幅超越 2026 年 3 月發布的 Gemini 3.1 Flash-Lite,甚至在 SWE-Bench Pro 與 OSWorld-Verified 項目中擊敗了更早期的 Gemini 3 Flash。
Gemini 3.5 Flash Cyber 專攻資安漏洞防禦
為了因應日漸複雜的程式碼安全問題,Google 推出了 Gemini 3.5 Flash Cyber。這款模型以 Flash 架構為基礎,以低於大型模型的 Token 成本,大規模偵測、驗證並修補程式碼安全漏洞。
目前 Google 開發的 CodeMender 工具已採用多個 Gemini 3.5 Flash Cyber 代理程式來運作。該模型初期將透過限制存取的測試計畫,優先提供給政府機關與受信任的合作夥伴使用,協助第一線防禦人員在漏洞被惡意利用前進行修復,並同時防止模型能力遭到濫用。
支援平台與 Gemini 4 未來展望
在服務供應方面,一般用戶現在已經可以在 Gemini app 中體驗 Gemini 3.6 Flash 與 Gemini 3.5 Flash-Lite,後者也即將整合至 Google Search 功能中,開發者則可以透過 Google Antigravity、AI Studio 以及 Android Studio 等平台存取這些全新模型。
在未來規劃部分,Google 表示 Gemini 3.5 Pro 目前正與合作夥伴進行測試,準備就緒後將會全面開放;同時,DeepMind 團隊也已經啟動了針對下一代模型 Gemini 4 歷來最大規模的預訓練工作。
