IA da dona do ChatGPT fez outro ataque hacker antes de empresa revelar incidente 'sem precedentes', dizem pesquisadores

Table of Contents


O logotipo da OpenAI é visto em um telefone celular em frente a uma tela de computador que exibe a tela inicial do ChatGPT
AP/Michael Dwyer, Arquivo
Agentes de inteligência artificial da OpenAI, dona do ChatGPT, fizeram outro ataque hacker dois meses antes de a empresa revelar uma invasão à plataforma de IA Hugging Face, informou nesta sexta-feira (11) um grupo de pesquisadores.
Segundo eles, a invasão descoberta agora aconteceu em maio e teve como alvo o serviço RubyGems, usado para compartilhar códigos da linguagem de programação Ruby, também conhecido como pacotes.
🗒️ Tem alguma sugestão de reportagem? Mande para o g1
“Em 11 de maio de 2026, centenas de pacotes maliciosos foram enviados para o RubyGems por agentes de IA. Acreditamos que eles foram criados por agentes internos da OpenAI”, disseram os pesquisadores.
A OpenAI confirmou o ataque ao Wall Street Journal, mas disse que seus agentes usaram o RubyGems para acessar a internet “a fim de realizar tarefas inofensivas e obter informações públicas”.
Agora no g1
IA pode decidir atacar empresas? Entenda como foi a invasão por modelos da OpenAI
“Continuaremos investigando como parte de nossa análise mais ampla da atividade dos agentes durante o treinamento e a avaliação”, disse a OpenAI ao jornal.
A OpenAI só informou o primeiro caso do tipo em julho, quando afirmou que dois de seus modelos invadiram os sistemas da plataforma de inteligência artificial Hugging Face.
Na ocasião, a empresa disse que a invasão tinha sido feita por meio dos modelos GPT-5.6 Sol e outro que ainda não tinha sido lançado e que eles conseguiram acessar dados e credenciais internas.
O incidente aconteceu durante testes em que a OpenAI faz seus modelos buscarem falhas em outros sistemas para melhorarem as capacidades de cibersegurança. Eles estavam em ambiente controlado, mas conseguiram escapar das barreiras e acessar sistemas reais da Hugging Face.
No início de setembro, a dona do ChatGPT anunciou o GPT-6 Astra, modelo de inteligência artificial que promete mais cautela para cumprir instruções de usuários. Foi é o primeiro lançamento da empresa após a revelação do ataque à Hugging Face.
A empresa afirmou que o GPT-6 Astra é o seu modelo mais alinhado às ordens e mais preparado para executar tarefas de forma cuidadosa e respeito aos limites estabelecidos. Segundo a companhia, ele ajuda usuários a delegar tarefas sem abrir mão da supervisão.
O sistema também conta com uma espécie de “desligamento automático”, que permite interromper as tarefas ao detectar comportamento potencialmente não autorizado.

Matéria original

Deixe um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *

This site uses Akismet to reduce spam. Learn how your comment data is processed.