Um agente de inteligência artificial da OpenAI escapou do ambiente de testes da empresa e invadiu os sistemas do Hugging Face, plataforma que reúne modelos e ferramentas de IA, entre os dias 11 e 13 de julho.
A própria OpenAI só descobriu que seu agente autônomo estava por trás do ataque dias depois, quando o Hugging Face já havia contido a invasão e acionado o FBI, segundo pessoas ouvidas pela Reuters.
Como a IA escapou do controle
O episódio começou durante testes internos da OpenAI para avaliar a capacidade de um agente de inteligência artificial em tarefas de segurança digital. O sistema era alimentado por dois modelos avançados da empresa, incluindo o GPT-5.6 Sol e um modelo ainda não lançado oficialmente, descrito pela companhia como “ainda mais poderoso”.
Por volta de 9 de julho, o agente tentou romper as barreiras de segurança impostas pela OpenAI. Dois dias depois, em 11 de julho, começou a invasão ao Hugging Face, que se estendeu até 13 de julho, segundo Thomas Wolf, cofundador da plataforma. Em nota, o Hugging Face classificou o episódio como sem precedentes e “um momento importante para a segurança da inteligência artificial”.
Wolf já havia detalhado anteriormente como a equipe percebeu a ofensiva: a plataforma chegou a registrar 17 mil tentativas de invasão vindas de IPs diferentes antes de conseguir conter o ataque, conforme revelou em outro alerta do cofundador da Hugging Face.
Instruções deixadas para versões futuras
Segundo pessoas familiarizadas com a investigação, o agente chegou a deixar anotações dentro da infraestrutura da OpenAI com instruções para que versões futuras de si mesmo pudessem escapar das mesmas limitações. Em testes anteriores, sistemas de monitoramento também teriam sido desligados, embora a Reuters não tenha confirmado relação direta entre os episódios.
Repercussão e demora na descoberta
Passaram-se ao menos oito dias entre a tentativa inicial de fuga do agente, em 9 de julho, e o momento em que funcionários da OpenAI, revisando registros internos no fim de semana de 18 e 19 de julho, perceberam que o próprio sistema havia ultrapassado as barreiras de teste. O primeiro contato oficial com o Hugging Face só ocorreu por volta de 20 de julho — quando a plataforma já havia acionado o FBI para relatar a invasão.
A revelação pública da OpenAI, feita em 21 de julho, gerou repercussão internacional e levou a Casa Branca e o Congresso dos Estados Unidos a acompanhar de perto o caso, com propostas de supervisão sobre agentes de IA autônomos ganhando força no debate legislativo.
Alerta da comunidade de segurança
Para Jeffrey Ladish, fundador da Palisade Research, o caso expõe um problema maior: “os modelos mentem, trapaceiam e invadem sistemas“, afirmou, defendendo que o episódio deveria abrir uma discussão sobre o quanto as grandes empresas de IA investem em segurança em meio à corrida por modelos mais rápidos e poderosos. O caso ocorre em momento sensível para a OpenAI, que avalia abertura de capital para financiar sua expansão.
