A OpenAI informou nesta terça-feira (21) que dois de seus modelos de inteligência artificial (IA) conseguiram escapar do ambiente de testes em que estavam sendo avaliados e invadir o Hugging Face, uma das principais plataformas de compartilhamento de modelos de IA do mundo.
Segundo a empresa, o incidente ocorreu na semana passada, durante um teste voltado à avaliação das capacidades de cibersegurança de seus sistemas. O objetivo era verificar se os modelos seriam capazes de explorar vulnerabilidades em sequência para realizar um ataque cibernético controlado.
De acordo com a OpenAI, foram utilizados o GPT-5.6 Sol e um modelo mais avançado, que ainda não foi lançado. Embora estivessem confinados em um ambiente isolado (sandbox), os sistemas encontraram uma vulnerabilidade que lhes permitiu escapar do isolamento e acessar a internet.
Após isso, os modelos direcionaram suas ações ao Hugging Face por inferirem que a plataforma, que reúne milhões de modelos de inteligência artificial, poderia conter informações úteis para melhorar seu desempenho na própria avaliação.
A OpenAI afirmou que está trabalhando em conjunto com o Hugging Face para corrigir as falhas exploradas durante o incidente. Em comunicado, a empresa classificou o episódio como um caso “sem precedentes” envolvendo capacidades cibernéticas de última geração e informou que adotará controles mais rigorosos em sua infraestrutura, ainda que isso reduza o ritmo das pesquisas.
O Hugging Face havia informado, na semana passada, que detectou a invasão e identificou que ela foi realizada por um sistema autônomo, mas não revelou, na ocasião, que a OpenAI estava por trás do teste. O CEO da plataforma, Clem Delangue, afirmou que o episódio reforça a necessidade de cooperação entre empresas para enfrentar os desafios da segurança em inteligência artificial.
O caso ocorre em meio ao avanço de modelos de IA especializados em programação e cibersegurança. Nos últimos meses, as gigantes norte-americanas OpenAI, Anthropic e Google anunciaram sistemas voltados à identificação de vulnerabilidades e ao fortalecimento da defesa de redes de computadores. Nesta terça-feira, o Google também informou ter desenvolvido um modelo focado em cibersegurança, disponibilizado, inicialmente, para um grupo restrito de parceiros de teste.




