TradingKey - Google ( GOOGL) lançou três novos modelos Gemini antes da divulgação de seus resultados do segundo trimestre de 2026 — o Gemini 3.6 Flash, o Gemini 3.5 Flash-Lite e o Gemini 3.5 Flash Cyber, que é projetado especificamente para segurança cibernética.
Entre eles, o 3.6 Flash e o Flash-Lite estão disponíveis a partir de hoje por meio da API do Gemini, do Google AI Studio, do Gemini Enterprise e dos aplicativos Gemini, enquanto o Flash-Lite também será integrado ao Google Search.
Em um momento em que o desenvolvimento de seu principal modelo de IA, o 3.5 Pro, está sob pressão e os concorrentes estão se aproximando, o Google aposta na relação custo-benefício.
Como uma atualização direta do 3.5 Flash, o 3.6 Flash apresenta avanços abrangentes em programação, trabalho intelectual e desempenho multimodal, ao mesmo tempo que melhora significativamente a eficiência de tokens. De acordo com o índice da Artificial Analysis, o uso de tokens de saída foi reduzido em 17% em comparação com o 3.5 Flash; em alguns benchmarks, como o DeepSWE da Datacurve, a redução chega a 65%. Ele também exige menos etapas de raciocínio e chamadas de ferramentas para concluir fluxos de trabalho de várias etapas.
Ao mesmo tempo, os preços oficiais foram reduzidos simultaneamente. A entrada custa US$ 1,50 por milhão de tokens e a saída custa US$ 7,50 por milhão de tokens, valores inferiores aos do 3.5 Flash, reduzindo o custo geral de cada tarefa de Agente.

[Fonte: Google Blog]
O 3.5 Flash-Lite é o modelo mais rápido da série 3.5, medido pela Artificial Analysis em 350 tokens de saída por segundo, com preço de apenas US$ 0,30 por milhão de tokens de entrada e US$ 2,50 por milhão de tokens de saída, voltado para cenários de baixa latência e alta vazão (throughput), como busca agêntica e processamento de documentos.
Em termos de desempenho, ele supera significativamente seu antecessor, o 3.1 Flash-Lite, em testes como o Terminal-Bench 2.1 (54% vs. 31%) e no benchmark de contexto longo GDM-MRCR v2 (72,2% vs. 60,1%). Mais notavelmente, no SWE-Bench Pro (54,2% vs. 49,6%) e no OSWorld-Verified (74,0% vs. 65,1%), ele supera até mesmo o Gemini 3 Flash, que possui um posicionamento superior. Os desenvolvedores podem configurar de forma flexível os níveis de raciocínio com base nas cargas de trabalho: direcionando tarefas de alta frequência para a camada de baixa latência e baixo custo, enquanto acionam níveis de raciocínio mais altos para tarefas de subagentes de várias etapas.

[Fonte: Google Blog]
O lançamento mais estratégico desta rodada é o Flash Cyber. Este modelo é especializado em descobrir e corrigir vulnerabilidades de software, com um preço por token inferior ao de modelos maiores. No agente de segurança de código CodeMender, múltiplos agentes Flash Cyber trabalham de forma colaborativa para agregar e gerar um único relatório, alcançando um desempenho competitivo de nível de fronteira no principal benchmark CyberGym.
Dada a natureza de uso duplo de tal tecnologia, o Google adotou uma estratégia de lançamento cautelosa: o Flash Cyber estará disponível em breve exclusivamente para governos e parceiros de confiança por meio do CodeMender como um piloto limitado, permitindo que os defensores de linha de frente corrijam vulnerabilidades antes que possam ser exploradas.

[Fonte: Google Blog]
Este movimento visa diretamente o reduto da Anthropic — esta última estabeleceu uma vantagem pioneira em defesa de código automatizada com seu modelo Mythos, e o Flash Cyber é uma jogada fundamental para o Google reduzir essa lacuna e comercializar as conquistas de pesquisa do DeepMind por meio de produtos de segurança corporativa.
Vale destacar que o modelo Gemini 3.5 Pro, o mais antecipado pelo mercado, não foi lançado nesta rodada, após relatos anteriores de que seu desenvolvimento está atrasado em vários meses. O posicionamento oficial do Google é de que o Gemini 3.5 Pro está atualmente em fase de testes com parceiros e será totalmente lançado assim que estiver pronto.
Os mercados de capitais adotaram uma postura de cautela em relação aos três modelos recém-lançados; até o momento da publicação, as ações do Google ainda registravam queda de cerca de 1%, negociadas a US$ 348,66.

[Fonte: TradingView]
Análises de mercado sugerem que isso pode estar relacionado à intensa concorrência externa. Por exemplo, a demanda pelo Kimi K3 da Moonshot AI é tão explosiva que a empresa limitou novas assinaturas e o acesso à API devido a restrições de capacidade, enquanto a Alibaba começou a divulgar prévias do Qwen 3.8 Max, alegando que seu desempenho geral fica atrás apenas do Fable 5 da Anthropic.
De acordo com dados da Artificial Analysis, o custo da série Gemini Flash já é inferior ao de modelos comparáveis da Anthropic, OpenAI e de fabricantes chineses — o custo de tarefa única do 3.6 Flash é, segundo relatos, menor do que o do GPT-5.6 Terra Max, Kimi K3 e Qwen 3.7 Max.