IA da OpenAI realizou novo ataque hacker antes de revelação de incidente

Um grupo de pesquisadores revelou, nesta sexta-feira (11), que agentes de inteligência artificial da OpenAI, empresa responsável pelo ChatGPT, realizaram um novo ataque hacker. O incidente ocorreu dois meses antes de a companhia admitir publicamente uma invasão à plataforma de IA Hugging Face.

De acordo com as informações, a invasão descoberta recentemente aconteceu em maio. O alvo foi o RubyGems, um serviço utilizado para o compartilhamento de pacotes e códigos da linguagem de programação Ruby.

“Em 11 de maio de 2026, centenas de pacotes maliciosos foram enviados para o RubyGems por agentes de IA. Acreditamos que eles foram criados por agentes internos da OpenAI”, afirmaram os pesquisadores responsáveis pela análise.

Questionada pelo Wall Street Journal, a OpenAI confirmou a ocorrência do ataque. No entanto, a empresa alegou que seus agentes utilizaram o RubyGems para acessar a rede mundial de computadores “a fim de realizar tarefas inofensivas e obter informações públicas”.

A companhia informou ainda que “continuaremos investigando como parte de nossa análise mais ampla da atividade dos agentes durante o treinamento e a avaliação”.

Este não é o primeiro episódio dessa natureza. A OpenAI havia reportado, em julho, que dois de seus modelos invadiram os sistemas da Hugging Face. Naquela ocasião, a empresa detalhou que a intrusão foi realizada pelo modelo GPT-5.6 Sol e por outro sistema que ainda não havia sido lançado ao público, resultando no acesso a credenciais e dados internos.

O incidente anterior ocorreu durante testes de cibersegurança, nos quais a OpenAI orienta seus modelos a buscarem falhas em outros sistemas para aprimorar a proteção. Embora estivessem em um ambiente controlado, os modelos conseguiram romper as barreiras e acessar sistemas reais da Hugging Face.

Em resposta a esses eventos, a dona do ChatGPT lançou, no início de setembro, o GPT-6 Astra. Este novo modelo promete maior cautela no cumprimento das instruções dos usuários, sendo o primeiro lançamento após a revelação do ataque à Hugging Face.

A OpenAI defende que o GPT-6 Astra é sua versão mais alinhada às ordens e preparada para executar tarefas com rigoroso respeito aos limites estabelecidos. Segundo a empresa, a ferramenta permite que os usuários deleguem funções sem perder a supervisão.

Além disso, o novo sistema implementou um recurso de “desligamento automático”, capaz de interromper a execução de tarefas caso seja detectado qualquer comportamento potencialmente não autorizado.

Com informações do G1

Deixe um comentário