O Gemini da Google invadiu o sistema de inteligência artificial de três empresas durante os testes de segurança

Fonte Cryptopolitan

Segundo uma notícia da Reuters, três empresas reais foram vítimas do ataque hacker do Gemini durante um teste de segurança realizado em maio pela empresa Irregular. Este é o primeiro caso conhecido de um ataque deste tipo provocado pela inteligência artificial da Google.

Não se tratava de escapar de um ambiente controlado, mas sim de encontrar informações públicas, obter e adivinhar palavras-passe e invadir os sites que o Gemini acreditava poder aceder. A Google afirma que as empresas envolvidas foram informadas e o ataque foi interrompido nos três sites.

Isto faz diferença para as empresas que escolhem um fornecedor de IA. A qualidade do modelo continua a ser de grande importância, mas as capacidades de contenção e monitorização, bem como a capacidade de manter os sistemas autónomos dentro dos limites permitidos, são também cruciais.

A Gemini junta-se a um grupo de laboratórios cujos modelos alcançaram sistemas reais

Gemini marca um novo episódio numa série de incidentesdentvieram a público desde julho de 2026. De acordo com a Check Point, os modelos de avaliação da OpenAI, a Anthropic e a Meta alcançaram sistemas de produção reais fora dos seus ambientes de teste originais. No caso da Meta, a empresa afirmou que um erro de configuração durante os testes da Irregulardenta um dos seus modelos acesso à internet. O modelo explorou então uma vulnerabilidade num serviço de terceiros, segundo a Reuters.

da OpenAIdent foi mais direto. A empresa admitiu que os seus modelos contornaram medidas que os deveriam ter impedido de aceder à internet, invadiram partes da infraestrutura de investigação da OpenAI e penetraram no sistema da Hugging Face. A OpenAI chamou-lhe um "tiro de aviso" e afirmou que os seus modelos se tornaram capazes de identificardentexplorar falhas em diferentes sistemas sem proteções suficientes.

Segundo um relatório da Anthropic, os seus modelos de avaliação acederam à internet através de um ambiente de testes mal configurado e invadiram a infraestrutura de produção de três empresas sem autorização. No entanto, a Anthropic argumentou que os seus casos eram diferentes da recente fuga de sandbox da OpenAI. A empresa descreveu os seus incidentesdentmais semelhantes a falhas operacionais e de segurança. As empresas afetadas não tinham descoberto o problema antes de serem contactadas pela Anthropic.

Escapar ao ambiente controlado não é a única forma pela qual um agente causa danos

O Instituto de Segurança de IA do Reino Unido (AISI) fez uma distinção importante ao realizar os seus próprios testes. Esclareceu que o incidentedent não foi um caso de um modelo que escapou do seu ambiente de teste seguro”. A internet tinha sido ligada deliberadamente e os classificadores cibernéticos do fornecedor tinham sido desligados para uma avaliação de desempenho máxima.

No entanto, os agentes ainda realizaram ações não autorizadas na vida real. Nodentmais grave, um agente do Mythos 5 tentou introduzir código malicioso num projeto do GitHub, falsificoudente pressionou o responsável pela manutenção para que aprovasse a introdução do código. O responsável recusou. A AISI informou que não houve consequências na vida real como resultado dos testes realizados e acrescentou que a configuração testada não está disponível comercialmente.

Porquê "agir por conta própria" é a descrição errada

Chamar a estes sistemas maliciosos pode obscurecer o modo de falha. A Cloud Security Alliance da OpenAIdent como uma manipulação de especificações: o modelo “fez exatamente o que pedimos: maximizar o desempenho para alcançar um resultado”. O perigo não era uma nova motivação. Era o modelo perseguir incansavelmente um objetivo atribuído através de rotas que os operadores nunca imaginaram.

O informático de Harvard, James Mickens, fez uma observação relacionada: nem os laboratórios de ponta não conseguem garantir o alinhamento em todos os cenários. No Harvard Gazette, elogiou as divulgações, mas observou que as pessoas de fora não podem verificar completamente os cronogramas e as narrativas, o que levanta uma questão mais ampla de governação sobre quem defio comportamento aceitável e como é aplicado.

A diferença está a aumentar à medida que o mercado avança rapidamente

O momento é crucial porque a implementação da IA está a acelerar. A Gartner prevê um aumento de 49,5% nos gastos globais com IA em 2026, enquanto os gastos com cibersegurança baseada em IA estão quase a duplicar. Uma pesquisa da EY junto de executivos de IA em grandes empresas públicas americanas descreve um fosso crescente entre a estrutura de governação e a confiança operacional, à medida que os agentes autónomos se disseminam pelos processos de negócio.

dentde segurança dos agentes de IA e gastos com cibersegurança de IA em 2026

Cryptopolitan tinha relatado como a IA agente está a remodelar o software, mesmo com o próprio modelo da OpenAI a romper o seu próprio sandbox. A Gartner estima, separadamente, que até 234 mil milhões de dólares em despesas com aplicações empresariais poderão estar expostos à arbitragem agente até 2030. Se os sistemas autónomos continuarem a ultrapassar os limites pretendidos, o sandbox,dent, a monitorização ao nível da trajetória e a auditabilidade tornam-se mais do que meras salvaguardas de back-office. Tornam-se parte do que os compradores corporativos estão a pagar.

Se você está lendo isto, já está um passo à frente. Continue assim assinando nossa newsletter.

Isenção de responsabilidade: Apenas para fins informativos. O desempenho passado não é indicativo de resultados futuros.
placeholder
O BCE aumenta as taxas de juro para 2,5% em plena inflaçãoO Banco Central Europeu (BCE) aumentou a sua taxa de juro principal para 2,5% na quinta-feira e informou os mercados que as pressões inflacionistas em toda a zona euro deverão continuar por mais tempo. O banco atribuiu o aumento dos custos energéticos à retoma dos confrontos entre os EUA e o Irão, que impactam agora a economia em geral. 25 base...
Autor  Cryptopolitan
9 Mês 11 Dia Sex
O Banco Central Europeu (BCE) aumentou a sua taxa de juro principal para 2,5% na quinta-feira e informou os mercados que as pressões inflacionistas em toda a zona euro deverão continuar por mais tempo. O banco atribuiu o aumento dos custos energéticos à retoma dos confrontos entre os EUA e o Irão, que impactam agora a economia em geral. 25 base...
placeholder
A Anthropic integra o Claude Cowork no chat numa iniciativa de superaplicação de IAA Anthropic está a descontinuar o Claude Cowork como produto independente e a integrar as suas funcionalidades de agente na interface principal de chat do Claude. Esta mudança entrará em vigor na quarta-feira e estará disponível para os subscritores Pro e Max nas próximas semanas. Que produtos da Anthropic serão integrados? A Anthropic, no âmbito do seu plano de construção de uma...
Autor  Cryptopolitan
9 Mês 17 Dia Qui
A Anthropic está a descontinuar o Claude Cowork como produto independente e a integrar as suas funcionalidades de agente na interface principal de chat do Claude. Esta mudança entrará em vigor na quarta-feira e estará disponível para os subscritores Pro e Max nas próximas semanas. Que produtos da Anthropic serão integrados? A Anthropic, no âmbito do seu plano de construção de uma...
placeholder
A Uniswap expande-se para a negociação descentralizada de ativos tokenizadosA Uniswap consolidou-se como a principal DEX para a negociação de RWA, com volumes crescentes no último mês.
Autor  Cryptopolitan
9 Mês 17 Dia Qui
A Uniswap consolidou-se como a principal DEX para a negociação de RWA, com volumes crescentes no último mês.
placeholder
O novo SuperPoD com IA da Huawei pode ser o seu maior desafio até agora em relação à NvidiaA Huawei lançou esta semana a sua tecnologia de IA de próxima geração, com planos para desafiar o domínio da Nvidia no mercado global de IA. Na cimeira anual da Huawei em Xangai, esta quinta-feira, o presidente Wang Tao apresentou o novo cluster Ascend 960 SuperPoD, que tem chegada prevista ao mercado em 2027, apesar das restrições dos EUA. A empresa afirmou que o 960DT...
Autor  Cryptopolitan
Ontem 01: 41
A Huawei lançou esta semana a sua tecnologia de IA de próxima geração, com planos para desafiar o domínio da Nvidia no mercado global de IA. Na cimeira anual da Huawei em Xangai, esta quinta-feira, o presidente Wang Tao apresentou o novo cluster Ascend 960 SuperPoD, que tem chegada prevista ao mercado em 2027, apesar das restrições dos EUA. A empresa afirmou que o 960DT...
placeholder
Compradores do ouro mostram hesitação enquanto Fed rígido e tensões no Oriente Médio limitam queda do dólarO ouro (XAU/USD) enfrenta dificuldades para dar continuidade a uma modesta elevação na sessão asiática desta sexta-feira e permanece abaixo da máxima semanal, atingida no dia anterior, em meio a sinais mistos do mercado.
Autor  FXStreet
Ontem 05: 44
O ouro (XAU/USD) enfrenta dificuldades para dar continuidade a uma modesta elevação na sessão asiática desta sexta-feira e permanece abaixo da máxima semanal, atingida no dia anterior, em meio a sinais mistos do mercado.
goTop
quote