A Mistral lançou uma prévia pública de seu modelo de pesos abertos com um trilhão de parâmetros, o Mistral Large 4 (ML4), que ela considera o mais poderoso de sua categoria desenvolvido fora da China.
A segurança cibernética é o principal diferencial do modelo apelidado de “Le Chonk”. O modelo está disponível por meio da API da Mistral. Em seu anúncio, a empresa afirmou que publicará os pesos para download por volta de 27 de outubro, após um teste de três semanas com desenvolvedores, empresas de segurança e agências governamentais.
Uma semana antes, em 29 de setembro, a Anthropic compartilhou descobertas de sua pesquisa, alertando que o GLM-5.3 de pesos abertos da Zhipu AI, conhecido fora da China como Z.ai, pode construir autonomamente exploits cibernéticos funcionais. A empresa também afirmou que ele poderia vir com salvaguardas fracas o suficiente para serem contornadas na maioria das vezes.
O co-fundador e cientista-chefe Guillaume Lample afirmou: “O ML4 está na fronteira dos modelos de pesos abertos.”
O modelo, lançado na terça-feira, 6 de outubro, foi submetido a um teste preliminar no DeepSWE v1.1, um teste de codificação agêntica, colocando o Large 4 em 62%, apenas um ponto percentual acima do GLM-5.3.
A pesquisa da Anthropic ajuda no posicionamento do produto da Mistral.
Em uma avaliação de 17 de setembro citada pela Anthropic, o Centro de Padrões e Inovação em IA do governo dos EUA classificou o GLM-5.3 como “o modelo de pesos abertos mais capaz em cibersegurança lançado até hoje”, ficando cerca de quatro meses atrás da fronteira dos EUA.
A própria equipe de Red Team (equipe de ataque) da Anthropic descobriu que o modelo poderia encadear falhas anteriormente desconhecidas em navegadores para criar uma exploração funcional em menos de um dia de trabalho levemente supervisionado.
As salvaguardas são o problema destacado pela Anthropic. A empresa escreveu que os atacantes contornaram as proteções integradas do GLM-5.3 “entre 64% e 100% das vezes” usando técnicas simples em testes simulados. A Anthropic afirmou que os mesmos ataques falharam contra os modelos Claude com salvaguardas.
As principais laboratórios de IA americanos mantiveram, em sua maioria, seus modelos mais capazes fora do lançamento geral. Um exemplo disso é o Anthropic Claude Mythos Preview, que é seu modelo cibernético mais capaz, e não está disponível para lançamento geral.
O que a Anthropic está fazendo em vez disso é direcionar o modelo por meio do Project Glasswing para cerca de 40 organizações selecionadas, pois considerou o modelo perigoso demais para ser distribuído amplamente.
A OpenAI também adotou uma rota semelhante em abril, ao restringir sua variante GPT-5.4-Cyber atrás de verificações de identidade em camadas em seu programa Trusted Access for Cyber. Em setembro, ela afirmou que seu modelo Astra ultrapassou o limiar "Crítico" cibernético em seu Framework de Preparação.
A Mistral está seguindo uma rota diferente de seus concorrentes americanos. Ela não está restringindo o modelo, argumentando que as equipes de segurança precisam verificar seus próprios sistemas diariamente. Essas equipes também observam que os modelos fechados são frequentemente muito custosos nesse volume e, em alguns casos, recusam solicitações de uso duplo outright.
“As capacidades de defesa cibernética permitirão que empresas e governos se defendam contra agentes maliciosos que estão contornando modelos fechados para realizar ataques cibernéticos”, disse Lample. Desenvolvedores, empresas de segurança cibernética e agências governamentais na versão preliminar receberão uma versão com menos restrições do que a API pública.
Em setembro, a Mistral anunciou que captou €3 bilhões (US$ 3,5 bilhões) com uma avaliação acima de €21 bilhões. O Large 4 é o primeiro modelo lançado desde esse anúncio.
O modelo foi treinado do zero ao longo de dois meses em cerca de 4.000 GPUs Nvidia Grace Blackwell nos data centers europeus da Mistral.
Não apenas leia notícias sobre criptomoedas. Entenda-as. Inscreva-se em nossa newsletter. É grátis.