Tradingkey - Google(GOOGL)於 26Q2 財報公布前,發布了三款 Gemini 新模型——Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 和專為網路安全打造的 Gemini 3.5 Flash Cyber。
其中 3.6 Flash 和 Flash-Lite 即日起已透過 Gemini API、Google AI Studio、Gemini Enterprise 及 Gemini 應用程式開放使用,Flash-Lite 還將登陸 Google 搜尋。
在旗艦 AI 模型 3.5 Ppro 進度承壓、競爭對手步步緊逼的當下,Google 把籌碼押在性價比上。
3.6 Flash 作為 3.5 Flash 的直接升級版,在程式碼編寫、知識工作和多模態性能上全面進階,同時大幅改善 token 效率。根據 Artificial Analysis 指數,其輸出 token 用量比 3.5 Flash 減少 17%;在 Datacurve 的 DeepSWE 等部分基準測試上,降幅最高達 65%。完成多步工作流程所需的推理步驟和工具呼叫也更少。
同時,官方定價同步調降。輸入每百萬 token 1.50 美元,輸出每百萬 token 7.50 美元,低於 3.5 Flash,整體降低了每個 Agent 任務的成本。

【來源:Google Blog】
3.5 Flash-Lite 是 3.5 系列中速度最快的型號,據 Artificial Analysis 測量達每秒 350 個輸出 token,定價僅為輸入每百萬 token 0.3 美元、輸出每百萬 token 2.5 美元,主打代理搜尋、文件處理等低延遲、高吞吐量場景。
性能上,它在 Terminal-Bench 2.1(54% vs 31%)、長文本基準 GDM-MRCR v2(72.2% vs 60.1%)等測試中大幅超越前代 3.1 Flash-Lite;更值得注意的是,在 SWE-Bench Pro(54.2% vs 49.6%)和 OSWorld-Verified(74.0% vs 65.1%)上,它甚至反超了定位更高的 Gemini 3 Flash。開發者可按負載靈活配置思考等級:高頻任務走低延遲、低成本檔位,多步子代理任務則呼叫更高思考等級。

【來源:Google Blog】
本輪最具戰略意義的是 Flash Cyber。該模型專攻軟體漏洞的發現與修復,每 token 價格低於大型模型。在 CodeMender 程式碼安全代理中,多個 Flash Cyber 代理協同工作、彙總生成單一報告,在主流基準 CyberGym 上達到具競爭力的領先水準。
鑑於這類技術的軍民兩用屬性,Google 採取了審慎的開放策略:Flash Cyber 即將透過 CodeMender 以限量試辦形式,獨家向政府和受信任的合作夥伴開放,讓第一線防禦者搶在漏洞被利用之前完成修補。

【來源:Google Blog】
此舉直指 Anthropic 腹地——後者憑藉 Mythos 模型在自動化程式碼防禦領域建立了先發優勢,而 Flash Cyber 正是 Google 縮小這一差距、並將 DeepMind 研究成果透過企業安全產品進行商業化的關鍵佈局。
值得注意的是,市場最關注的 Gemini 3.5 Pro 模型並未在本次發布中推出,先前有報導指出其進度落後數月。Google 官方說法是,3.5 Pro 正在與合作夥伴測試中,準備就緒後將盡快全面開放。
資本市場對本次發布的三款新模型持觀望態度,截至截稿前,Google 股價仍下跌約 1%,報 348.66 美元。

【來源:TradingView】
市場分析指出,這或許與外部競爭激烈有關。其中月之暗面的 Kimi K3 需求火熱到因產能限制而收緊新訂閱與 API 存取;阿里巴巴則開始預熱 Qwen 3.8 Max,宣稱綜合性能僅次於 Anthropic 的 Fable 5。
根據 Artificial Analysis 的數據,Gemini Flash 系列在成本上已低於 Anthropic、OpenAI 及中國廠商的同類模型——3.6 Flash 的單一任務成本據稱低於 GPT-5.6 Terra Max、Kimi K3 與 Qwen 3.7 Max。