Tradingkey - 谷歌(GOOGL)于26Q2财报公布前,发布了三款Gemini新模型——Gemini 3.6 Flash、Gemini 3.5 Flash-Lite和专为网络安全打造的Gemini 3.5 Flash Cyber。
其中3.6 Flash和Flash-Lite即日起已通过Gemini API、Google AI Studio、Gemini Enterprise及Gemini应用开放使用,Flash-Lite还将登陆Google搜索。
在旗舰AI模型3.5 Ppro进度承压、竞争对手步步紧逼的当下,谷歌把筹码押在性价比上。
3.6 Flash作为3.5 Flash的直接升级版,在编码、知识工作和多模态性能上全面进阶,同时大幅改善token效率。根据Artificial Analysis指数,其输出token用量比3.5 Flash减少17%;在Datacurve的DeepSWE等部分基准上,降幅最高达65%。完成多步工作流所需的推理步骤和工具调用也更少。
同时,官方定价同步下调。输入每百万token1.50美元,输出每百万token7.50美元,低于3.5 Flash,整体拉低了每个Agent任务的成本。

【来源:google blog】
3.5 Flash-Lite是3.5系列中速度最快的型号,据Artificial Analysis测量达每秒350个输出token,定价仅为输入每百万token0.3美元、输出每百万token2.5美元,主打代理搜索、文档处理等低延迟、高吞吐场景。
性能上,它在Terminal-Bench 2.1(54% vs 31%)、长文本基准GDM-MRCR v2(72.2% vs 60.1%)等测试中大幅超越前代3.1 Flash-Lite;更值得注意的是,在SWE-Bench Pro(54.2% vs 49.6%)和OSWorld-Verified(74.0% vs 65.1%)上,它甚至反超了定位更高的Gemini 3 Flash。开发者可按负载灵活配置思考等级:高频任务走低延迟低成本档位,多步子代理任务则调用更高思考等级。

【来源:google blog】
本轮最具战略意义的是Flash Cyber。该模型专攻软件漏洞的发现与修复,每token价格低于大型模型。在CodeMender代码安全代理中,多个Flash Cyber代理协同工作、汇总生成单一报告,在主流基准CyberGym上达到有竞争力的前沿水平。
鉴于这类技术的军民两用属性,谷歌采取了审慎的开放策略:Flash Cyber即将通过CodeMender以限量试点形式,独家向政府和受信任合作伙伴开放,让一线防御者抢在漏洞被利用之前完成修补。

【来源:google blog】
此举直指Anthropic腹地——后者凭借Mythos模型在自动化代码防御领域建立了先发优势,而Flash Cyber正是谷歌缩小这一差距、并将DeepMind研究成果经企业安全产品商业化的关键落子。
值得注意的是,市场最关注的Gemini 3.5 Pro模型并没有在本轮发布,此前有报道称其进度落后数月。谷歌官方口径是,3.5 Pro正在与合作伙伴测试中,就绪后将尽快全面开放。
资本市场对本次发布的三款新模型持有观望态度,截至发稿,谷歌股价仍跌约1%,报348.66美元。

【来源:TradingView】
市场分析称,这或许与外部竞争激烈有关。其中月之暗面的Kimi K3需求火爆到因产能限制收紧新订阅和API访问;阿里巴巴则开始预热Qwen 3.8 Max,宣称综合性能仅次于Anthropic的Fable 5。
据Artificial Analysis数据,Gemini Flash系列在成本上已低于Anthropic、OpenAI及中国厂商的同类模型——3.6 Flash的单任务成本据称低于GPT-5.6 Terra Max、Kimi K3和Qwen 3.7 Max。