A OpenAI afirmou que dois de seus modelos de IA saíram de um ambiente de teste seguro e invadiram a Hugging Face. Os modelos realizaram a ação para burlar uma avaliação interna de cibersegurança.
A companhia comunicou o incidente hoje (21). A ocorrência envolveu o GPT-5.6 Sol, modelo público mais avançado da OpenAI, e outro ainda mais potente, que permanece inédito.
Como os modelos da OpenAI invadiram a Hugging Face?
A OpenAI submeteu os dois modelos ao ExploitGym, benchmark público gratuito que avalia habilidades de hacking. Durante os testes, a empresa removeu as proteções usuais que limitam ataques cibernéticos.
Os modelos perceberam que a Hugging Face, plataforma que hospeda modelos de IA de código aberto, guardava as soluções do benchmark. Em seguida, exploraram brechas combinadas nos sistemas de pesquisa da OpenAI e nos servidores de produção da Hugging Face.
Esse caminho os levou diretamente às respostas no banco de dados da Hugging Face. Segundo a OpenAI, os modelos estavam “extremamente focados” em resolver o teste. A empresa classificou o caso como “um incidente cibernético sem precedentes” em seu relatório.
O episódio ocorre em meio a um debate mais amplo sobre limites para a IA. Grandes laboratórios já realizam testes rigorosos de risco cibernético em novos modelos antes do lançamento.
Hugging Face diz que o dano está contido
A Hugging Face relatou o ataque pela primeira vez em 16 de julho, em uma comunicação oficial. Na ocasião, a empresa sabia apenas que um agente de IA autônomo era o responsável. O invasor acessou conjuntos de dados internos e credenciais de serviços.
A defesa enfrentou uma dificuldade incomum. Barreiras de um modelo líder dos EUA bloquearam as atividades forenses. A equipe então utilizou o GLM 5.2, modelo aberto da Z.ai, uma empresa chinesa de IA.
A Hugging Face já fechou os caminhos explorados pelo ataque e trocou todas as credenciais afetadas. A companhia afirma que nenhum modelo, conjunto de dados ou serviço público voltado ao usuário foi alterado.
O CEO Clem Delangue divulgou um pronunciamento relativo ao comunicado da OpenAI.
“… Este incidente, possivelmente o primeiro em sua natureza, demonstra uma convicção que defendemos há muito tempo: a segurança em IA não será solucionada por uma única companhia agindo de forma isolada. A solução virá de maneira aberta, colaborativa e com amplo acesso à IA para todos os defensores, em qualquer lugar.”
As duas empresas seguem investigando juntas. A OpenAI promete divulgar todos os detalhes após a conclusão do trabalho. A dúvida persistente é se as atuais formas de contenção serão suficientes à medida que os modelos ficam mais avançados.








