IA da dona do ChatGPT fez outro ataque hacker antes de empresa revelar incidente ‘sem precedentes’, dizem pesquisadores
/i.s3.glbimg.com/v1/AUTH_59edd422c0c84a879bd37670ae4f538a/internal_photos/bs/2026/y/G/2QDIvUTmuV4oP2QYlmqg/ap26105015984564.jpg)
O logotipo da OpenAI é visto em um telefone celular em frente a uma tela de computador que exibe a tela inicial do ChatGPT — Foto: AP/Michael Dwyer, Arquivo
O logotipo da OpenAI é visto em um telefone celular em frente a uma tela de computador que exibe a tela inicial do ChatGPT — Foto: AP/Michael Dwyer, Arquivo
Segundo eles, a invasão descoberta agora aconteceu em maio e teve como alvo o serviço RubyGems, usado para compartilhar códigos da linguagem de programação Ruby, também conhecido como pacotes.
“Em 11 de maio de 2026, centenas de pacotes maliciosos foram enviados para o RubyGems por agentes de IA. Acreditamos que eles foram criados por agentes internos da OpenAI”, disseram os pesquisadores.
A OpenAI confirmou o ataque ao Wall Street Journal, mas disse que seus agentes usaram o RubyGems para acessar a internet “a fim de realizar tarefas inofensivas e obter informações públicas”.
Agora no g1
“Continuaremos investigando como parte de nossa análise mais ampla da atividade dos agentes durante o treinamento e a avaliação”, disse a OpenAI ao jornal.
A OpenAI só informou o primeiro caso do tipo em julho, quando afirmou que dois de seus modelos invadiram os sistemas da plataforma de inteligência artificial Hugging Face.
Na ocasião, a empresa disse que a invasão tinha sido feita por meio dos modelos GPT-5.6 Sol e outro que ainda não tinha sido lançado e que eles conseguiram acessar dados e credenciais internas.
O incidente aconteceu durante testes em que a OpenAI faz seus modelos buscarem falhas em outros sistemas para melhorarem as capacidades de cibersegurança. Eles estavam em ambiente controlado, mas conseguiram escapar das barreiras e acessar sistemas reais da Hugging Face.
No início de setembro, a dona do ChatGPT anunciou o GPT-6 Astra, modelo de inteligência artificial que promete mais cautela para cumprir instruções de usuários. Foi é o primeiro lançamento da empresa após a revelação do ataque à Hugging Face.
A empresa afirmou que o GPT-6 Astra é o seu modelo mais alinhado às ordens e mais preparado para executar tarefas de forma cuidadosa e respeito aos limites estabelecidos. Segundo a companhia, ele ajuda usuários a delegar tarefas sem abrir mão da supervisão.
O sistema também conta com uma espécie de “desligamento automático”, que permite interromper as tarefas ao detectar comportamento potencialmente não autorizado.




