TradingKey - Google (GOOGL) lançou dois novos modelos em 2 de setembro, no horário do Leste dos EUA: Gemini 3.8 Flash e Gemini 3.8 Flash Cyber. Este é o terceiro modelo da série Flash lançado pelo Google em seis semanas, dando continuidade aos recursos de alta velocidade e baixo custo do Gemini 3.7 Flash anterior, enquanto aprimora ainda mais a geração de código, o raciocínio complexo, tarefas agênticas e capacidades de cibersegurança.
O primeiro é direcionado para engenharia de software, agentes de IA e tarefas de raciocínio em múltiplas etapas em áreas especializadas; o segundo se concentra na descoberta de vulnerabilidades e remediação automatizada, disponível apenas para defensores verificados e confiáveis.
Embora os dois modelos se destinem a diferentes casos de uso, ambos são baseados no mesmo núcleo de inteligência subjacente e avaliam e otimizam repetidamente as saídas do modelo por meio de loops de agentes de longa duração.
A principal atualização do Gemini 3.8 Flash foca no tratamento de tarefas complexas e contínuas que exigem chamadas de ferramentas em múltiplas etapas. A Google afirmou que, em testes selecionados, o desempenho do modelo se aproxima do de modelos de ponta de maior custo.
No benchmark de engenharia de software de longo alcance DeepSWE v1.1, o Gemini 3.8 Flash atingiu 73,7%, superando os 65,3% do Gemini 3.7 Flash, além de ultrapassar os 72,7% do GPT-5.6 Sol e os 69,6% do GPT-5.6 Terra, ficando apenas ligeiramente atrás dos 74,0% do Claude Opus 5.

Fonte: Google
Em tarefas de domínios especializados, o Gemini 3.8 Flash também demonstrou forte competitividade. Entre elas, o HLE-Verified abrange questões multidisciplinares que englobam ciência, tecnologia, ciências humanas e conhecimento profissional, nas quais o Gemini 3.8 Flash também superou os 31,0% do Claude Sonnet 5, os 51,1% do GPT-5.6 Terra, os 54,4% do Claude Opus 5 e os 54,5% do GPT-5.6 Sol.
Em termos de preços, o Gemini 3.8 Flash mantém a precificação inicial do Gemini 3.7 Flash: US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de tokens de saída.
Em comparação, os preços de entrada e saída do Claude Opus 5 são de US$ 5 e US$ 25, respectivamente; do GPT-5.6 Sol, US$ 4 e US$ 20; e do GPT-5.6 Terra, US$ 2 e US$ 12.
Isso significa que o Gemini 3.8 Flash se aproxima ou até supera modelos maiores em benchmarks selecionados de programação e raciocínio, mas com um custo de chamada de API significativamente menor. Para desenvolvedores que buscam implementar agentes de código, análises automatizadas e fluxos de trabalho corporativos, sua eficiência de custo pode ser seu principal diferencial.
O Gemini 3.8 Flash Cyber é outro modelo fundamental lançado nesta ocasião, voltado principalmente para cenários de defesa em cibersegurança. O Google declarou que o modelo não estará amplamente disponível, mas será fornecido a equipes de defesa credenciadas e de confiança por meio do novo programa Fairwind.
No benchmark de descoberta de vulnerabilidades CyberGym, comumente utilizado no setor de cibersegurança, o Gemini 3.8 Flash Cyber obteve a pontuação de 86,2%, superando os 77,5% do Gemini 3.5 Flash Cyber e ultrapassando também os 83,6% do GPT-5.6 Sol, os 83,8% do Mythos 5 e os 85,6% do GPT-5.5-Cyber.
Em testes internos de cenários do mundo real abrangendo 20 linguagens de programação, o Gemini 3.8 Flash Cyber atingiu uma taxa de sucesso na descoberta de vulnerabilidades de 71,0%, superior aos 58,9% do Gemini 3.7 Flash e aos 46,6% do Gemini 3.5 Flash Cyber.
Em termos de remediação automatizada, o Gemini 3.8 Flash Cyber obteve uma taxa pass@1 de 47,2% no teste CWE-Bench executado pela Collinear, valor próximo dos 47,8% dos principais modelos de ponta, embora o Google tenha ressaltado seu custo mais baixo.