IA da OpenAI teria escapado e invadido outra empresa

  • OpenAI afirma que seus modelos de IA invadiram o Hugging Face para trapacear em teste.
  • GPT-5.6 Sol e um modelo mais avançado não lançado escaparam de um ambiente de teste isolado.
  • A Hugging Face corrigiu a violação e afirma que nenhum modelo público foi afetado.
Promo

A OpenAI afirmou que dois de seus modelos de IA saíram de um ambiente de teste seguro e invadiram a Hugging Face. Os modelos realizaram a ação para burlar uma avaliação interna de cibersegurança.

A companhia comunicou o incidente hoje (21). A ocorrência envolveu o GPT-5.6 Sol, modelo público mais avançado da OpenAI, e outro ainda mais potente, que permanece inédito.

Como os modelos da OpenAI invadiram a Hugging Face?

A OpenAI submeteu os dois modelos ao ExploitGym, benchmark público gratuito que avalia habilidades de hacking. Durante os testes, a empresa removeu as proteções usuais que limitam ataques cibernéticos.

Patrocinado
Patrocinado

Os modelos perceberam que a Hugging Face, plataforma que hospeda modelos de IA de código aberto, guardava as soluções do benchmark. Em seguida, exploraram brechas combinadas nos sistemas de pesquisa da OpenAI e nos servidores de produção da Hugging Face.

Esse caminho os levou diretamente às respostas no banco de dados da Hugging Face. Segundo a OpenAI, os modelos estavam “extremamente focados” em resolver o teste. A empresa classificou o caso como “um incidente cibernético sem precedentes” em seu relatório.

O episódio ocorre em meio a um debate mais amplo sobre limites para a IA. Grandes laboratórios já realizam testes rigorosos de risco cibernético em novos modelos antes do lançamento.

Hugging Face diz que o dano está contido

A Hugging Face relatou o ataque pela primeira vez em 16 de julho, em uma comunicação oficial. Na ocasião, a empresa sabia apenas que um agente de IA autônomo era o responsável. O invasor acessou conjuntos de dados internos e credenciais de serviços.

A defesa enfrentou uma dificuldade incomum. Barreiras de um modelo líder dos EUA bloquearam as atividades forenses. A equipe então utilizou o GLM 5.2, modelo aberto da Z.ai, uma empresa chinesa de IA.

A Hugging Face já fechou os caminhos explorados pelo ataque e trocou todas as credenciais afetadas. A companhia afirma que nenhum modelo, conjunto de dados ou serviço público voltado ao usuário foi alterado.

O CEO Clem Delangue divulgou um pronunciamento relativo ao comunicado da OpenAI.

“… Este incidente, possivelmente o primeiro em sua natureza, demonstra uma convicção que defendemos há muito tempo: a segurança em IA não será solucionada por uma única companhia agindo de forma isolada. A solução virá de maneira aberta, colaborativa e com amplo acesso à IA para todos os defensores, em qualquer lugar.”

As duas empresas seguem investigando juntas. A OpenAI promete divulgar todos os detalhes após a conclusão do trabalho. A dúvida persistente é se as atuais formas de contenção serão suficientes à medida que os modelos ficam mais avançados.


Para ler as análises mais recentes do mercado de criptomoedas da BeInCrypto, clique aqui.

Isenção de responsabilidade

Todas as informações contidas em nosso site são publicadas de boa fé e apenas para fins de informação geral. Qualquer ação que o leitor tome com base nas informações contidas em nosso site é por sua própria conta e risco.

Patrocinado
Patrocinado