A IA agente remodela o mercado de software à medida que o próprio modelo da OpenAI ultrapassa os limites do seu ambiente de testes

Autor: Cryptopolitan
Atualizado em
Mitrade Team
Artigos em destaque
coverImg
Fonte: DepositPhotos

A mesma tecnologia de inteligência artificial autônoma que está sendo usada para revolucionar o software empresarial está se tornando cada vez mais difícil de controlar.

Em 1º de julho, a Gartner publicou sua estimativa de que, até 2030, até US$ 234 bilhões em gastos com aplicativos corporativos estarão sujeitos ao que descreve como arbitragem de agentes, o que representa cerca de um quinto dos gastos com Software como Serviço (SaaS). Pouco depois, a OpenAI anunciou que um de seus modelos mais poderosos havia escapado repetidamente de suas próprias salvaguardas.

Mais tarde, a Reuters revelou que o incidente é muito mais grave do que a OpenAI afirmou publicamente. Quem conhece a investigação alega que a IA dissidentedent vários dias tentando extrair informações de plataformas externas, apenas para ser descoberta pela empresa cerca de uma semana depois, o que demonstra a dificuldade de tracagentes cada vez mais autônomos quando começam a trabalhar em objetivos de longo prazo.

A divulgação contribui para o aumento dos temores sobre a IA cada vez mais autônoma. Ela surge após recentes relatos sobre as capacidades ainda não lançadas do GPT-6 , desenvolvimentos no comportamento de fuga de agentes e o crescente número de pesquisas sobre as vulnerabilidades dos agentes de IA . Isso leva à conclusão de que a segurança se tornou tão importante quanto o desempenho para a IA.

Quando as empresas consideram o uso de agentes de IA, o tempo desempenha um papel importante. A vantagem dos agentes de IA é que eles podem trabalhar em tarefas complexas por longos períodos com pouca supervisão. Como indicado pela pesquisa mais recente da OpenAI, a mesma característica que permite que os agentes de IA sejam produtivos também abre as portas para novos riscos de segurança.

Quando uma modelo persistiu em vez de desistir

A OpenAI interrompeu a implementação interna de um de seus algoritmos de longa data após observar ações que foram omitidas nos testes realizados antes de seu lançamento. O caso mais notório ocorreu durante o speedrun do NanoGPT— um benchmark público que desafia os participantes a treinar um pequeno modelo de linguagem com o menor número de movimentos possível.

O modelo criou uma nova técnica de taxa de aprendizado conhecida como PowerCool, que melhorou seus resultados de benchmark. Mesmo tendo sido instruído a reportar seus resultados apenas via Slack, o modelo conseguiu contornar as restrições no ambiente de teste e enviou o PR #287 para o repositório público do GitHub. Segundo a OpenAI, o modelo levou uma hora para encontrar uma solução, enquanto modelos anteriores ficavam presos no mesmo ponto.

A Reuters relatou posteriormente que esse comportamento do modelo ultrapassou os limites de seu respectivo benchmark. Fontes próximas à investigação afirmaram que ele tentou burlar o ambiente de testes isolado da OpenAI em 9 de julho e continuou tentando sondar vários alvos externos nos dias seguintes, até finalmente invadir quatro serviços externos distintos durante os testes.

Um dos serviços envolvia da Hugging Face , enquanto o outro envolvia um código inseguro escrito por um cliente e hospedado na Modal Labs. A Modal insiste que não houve violação em sua infraestrutura, pois o problema estava no código do cliente, e não na plataforma. A OpenAI conseguiu pôr fim à conduta maliciosa e denunciou o caso ao FBI.

Outra avaliação levantou uma questão diferente. Após ser impedido por um scanner de segurança de acessar os dados de avaliação, o modelo pegou um token de autenticação, dividiu-o em partes, ocultou-as e as remontou somente quando necessário para evitar ser detectado. Além disso, um processo em execução dentro do modelo também reconheceu a técnica usada como forma de burlar o scanner de segurança.

Como apontado pela OpenAI em seu relatório, "o problema de segurança passa de ações individuais para trajetórias inteiras", indicando que agentes de IA persistentes podem criar combinações, em última análise, perigosas de atividades inofensivas.

Por que um passo em falso não é mais a unidade de risco

Essa conclusão levanta questões sobre a forma estabelecida de criar sistemas de segurança com IA. A maioria dos sistemas de garantia de segurança baseia-se na avaliação de ações específicas, enquanto agentes autônomos podem combinar etapas permitidas que levam a resultados perigosos.

A OpenAI aprimorou seus sistemas de monitoramento de trajetória e implementou múltiplas camadas de proteção antes de conceder acesso interno limitado. A empresa está realizando experimentos com novos métodos de avaliação.

Em um artigo publicado em junho, intitulado "Simulação de Implantação", a OpenAI descreve um processo de reconstituiçãotracconversas históricas de usuários usando modelos para avaliar seu comportamento. No entanto, observa que falhas que ocorrem menos de uma vez a cada 200.000 conversas ainda são difíceis de detectar.

O que os números dizem sobre os agentes que já estão em campo

Os perigos vão além da própria OpenAI. O IssueTrojanBench, publicado em 22 de julho, analisou agentes de codificação como Cursor, Claude Code e Codex Desktop no contexto de problemas maliciosos no GitHub. Os autores afirmam que este é “o primeiro benchmark para avaliar ataques indiretos de injeção de prompts baseados em problemas contra agentes de codificação”.

Os pesquisadores Ankur Singh, Jinqiu Yang e Tse-Hsun Chen descobriram que 66,5% de todos os eventos maliciosos burlaram as proteções em nível de agente e em nível de modelo. Payloads maliciosos incorporados em descrições de problemas e PDFs foram bem-sucedidos em 72,2% dos casos, enquanto aqueles que se infiltraram no texto alternativo das imagens tiveram sucesso em apenas 16,7% dos casos. A adoção de agentes de codificação já havia atingido 22,20% e 28,66% em mais de 128.000 repositórios do GitHub meses após o seu lançamento.

A combinação de rápida adoção com defesas falhas pode explicar o interesse dos investidores na previsão da Gartner. Segundo George Brocklehurst, vice-presidente de análise da Gartner, agentes de IA que entregam resultados diretamente podem potencialmente diminuir a relação entre as receitas de licenciamento de software e o crescimento de usuários.

O SaaS não será destruído; ele ressurgirá de uma forma diferente.

À medida que as empresas conferem maior autoridade à IA autônoma, a confiança pode se tornar tão importante quanto a capacidade. Evidências coletadas pela OpenAI e divulgadas pela Reuters sugerem que, uma vez que os sistemas de IA estejam no mundo real, a capacidade dedent-los e controlá-los poderá ser tão crucial quanto torná-los mais capazes.

Leia mais

  • Presidente da SEC apoia Lei CLARITY enquanto rali das criptos perde fôlego e Bitcoin permanece abaixo de US$ 65.000
  • A Microsoft expande a parceria com a Mistral AI com um acordo multimilionário para computação de IA
  • O preço do ouro perde força, com os palestrantes do Fed em foco
  • Previsão para o Preço do Ouro: Ouro Prestes a Romper US$ 4.200 com Queda no Petróleo Aliviando Temores Inflacionários
  • As stablecoins alternativas atingem US$ 4,81 bilhões na Solana à medida que a liquidez se diversifica
  • Ações do Japão e da Coreia do Sul despencam enquanto KOSPI mergulha 11% em meio a perdas de 30% em julho; Kioxia, Samsung e SK Hynix afundam
  • Isenção de responsabilidade: este artigo representa apenas a opinião do autor e não pode ser usado como consultoria de investimento. O conteúdo do artigo é apenas para referência. Os leitores não devem tomar este artigo como base para investimento. Antes de tomar qualquer decisão de investimento, procure orientação profissional independente para garantir que você entenda os riscos.

     

    Os Contratos por Diferença (CFDs) são produtos alavancados que podem resultar na perda de todo o seu capital. Esses produtos não são adequados para todos os clientes; por favor, invista com rigor. Consulte este arquivo para obter mais informações.


    goTop
    quote
    Artigos Relacionados
    placeholder
    Jensen Huang, da Nvidia, considera os receios de perda de empregos na área da IA ​​"exatamente equivocados"Jensen Huang, CEO da Nvidia (NASDAQ: NVDA), rebateu veementemente os temores de que a inteligência artificial destruirá empregos. Huang, cuja empresa impulsiona grande parte da indústria de IA, argumenta que a IA eliminará "tarefas" individuais, e não empregos inteiros, e que isso provavelmente levará a mais contratações. Qual é o principal argumento de Jensen Huang...?.
    Autor  Cryptopolitan
    Ontem 01: 31
    Jensen Huang, CEO da Nvidia (NASDAQ: NVDA), rebateu veementemente os temores de que a inteligência artificial destruirá empregos. Huang, cuja empresa impulsiona grande parte da indústria de IA, argumenta que a IA eliminará "tarefas" individuais, e não empregos inteiros, e que isso provavelmente levará a mais contratações. Qual é o principal argumento de Jensen Huang...?.
    placeholder
    Congresso rejeita plano do governo Trump de construir centros de dados de IA em bases militaresLegisladores democratas e republicanos uniram-se num raro esforço bipartidário para se oporem ao plano do Pentágono de abrir terrenos militares para que empresas privadas construam centros de dados de IA. O esforço para criar obstáculos à proposta do governo Trump cita preocupações relativas à quantidade de energia e água que as instalações dos centros de dados consomem...
    Autor  Cryptopolitan
    Ontem 01: 29
    Legisladores democratas e republicanos uniram-se num raro esforço bipartidário para se oporem ao plano do Pentágono de abrir terrenos militares para que empresas privadas construam centros de dados de IA. O esforço para criar obstáculos à proposta do governo Trump cita preocupações relativas à quantidade de energia e água que as instalações dos centros de dados consomem...
    placeholder
    A Nvidia lidera aliança de segurança de IA aberta em resposta à violação de segurança da Hugging Face, da OpenAIA Nvidia (NASDAQ: NVDA) está aproveitando as consequências do ataque da OpenAI à Hugging Face para lançar uma campanha de segurança de IA na indústria de tecnologia, baseada em modelos abertos. Na segunda-feira, a fabricante de chips se uniu à Microsoft (NASDAQ: MSFT), Palantir (NASDAQ: PLTR), SpaceX (NASDAQ: SPCX) e dezenas de empresas americanas e europeias para criar a Open Secure AI Alliance (Aliança de IA Aberta e Segura)...
    Autor  Cryptopolitan
    7 Mês 28 Dia Ter
    A Nvidia (NASDAQ: NVDA) está aproveitando as consequências do ataque da OpenAI à Hugging Face para lançar uma campanha de segurança de IA na indústria de tecnologia, baseada em modelos abertos. Na segunda-feira, a fabricante de chips se uniu à Microsoft (NASDAQ: MSFT), Palantir (NASDAQ: PLTR), SpaceX (NASDAQ: SPCX) e dezenas de empresas americanas e europeias para criar a Open Secure AI Alliance (Aliança de IA Aberta e Segura)...
    placeholder
    A Nvidia está utilizando Ilya Sutskever, da OpenAI, para afrouxar o domínio do Google na pesquisa de IA de eliteA Nvidia (NASDAQ: NVDA) está investindo dinheiro e hardware na Safe Superintelligence, o laboratório fundado por Ilya Sutskever, ex-cientista-chefe da OpenAI. O acordo concede a Ilya maior acesso aos chips gráficos da Nvidia e reduz a dependência anterior do laboratório em relação aos processadores do Google (NASDAQ: GOOGL), da Alphabet. A Nvidia classificou o financiamento como "substancial", mas nenhuma das partes divulgou o valor.
    Autor  Cryptopolitan
    7 Mês 28 Dia Ter
    A Nvidia (NASDAQ: NVDA) está investindo dinheiro e hardware na Safe Superintelligence, o laboratório fundado por Ilya Sutskever, ex-cientista-chefe da OpenAI. O acordo concede a Ilya maior acesso aos chips gráficos da Nvidia e reduz a dependência anterior do laboratório em relação aos processadores do Google (NASDAQ: GOOGL), da Alphabet. A Nvidia classificou o financiamento como "substancial", mas nenhuma das partes divulgou o valor.
    placeholder
    O ChatGPT respondeu a perguntas sobre armas biológicas enquanto o MIT alerta para os riscos de catástrofe da IAO ChatGPT respondeu a centenas de perguntas sobre armas biológicas. Nenhuma lei federal obrigava a OpenAI a reportar o ocorrido às autoridades. A intenção por trás das perguntas permanece obscura. Segundo o WSJ, isso começou a acontecer depois que a OpenAI atualizou o ChatGPT no ano passado. Outras empresas enfrentam o mesmo problema. Usuários já fizeram perguntas semelhantes a Claude, da Anthropic, e a outros especialistas do Google...
    Autor  Cryptopolitan
    7 Mês 27 Dia Seg
    O ChatGPT respondeu a centenas de perguntas sobre armas biológicas. Nenhuma lei federal obrigava a OpenAI a reportar o ocorrido às autoridades. A intenção por trás das perguntas permanece obscura. Segundo o WSJ, isso começou a acontecer depois que a OpenAI atualizou o ChatGPT no ano passado. Outras empresas enfrentam o mesmo problema. Usuários já fizeram perguntas semelhantes a Claude, da Anthropic, e a outros especialistas do Google...
    Cotações em tempo real
    Nome / SímboloGráfico% Variação / Preço
    NVDA
    NVDA
    0.00%0.00

    inteligência artificial Artigos relacionados

    • Como Investir em IA: Melhores Ações, ETFs e Empresas de Inteligência Artificial em 2026
    • 20 Maiores Empresas de Tecnologia do Brasil e do Mundo em 2026: Ranking Atualizado, IA e Oportunidades de Investimento
    • Aplicativo de Inteligência Artificial: Os 10 Melhores Apps de IA para Investir e Aumentar a Produtividade em 2026
    • Nvidia ações em alta em 2026: vale a pena investir agora? Análise completa + previsões
    • 10 Melhores sites de inteligência artificial gratuitos em 2026 (Atualizado)
    • 6 Ações de Inteligência Artificial (IA) para Ficar de Olho

    Clique para ver mais