OpenAI apura incidente após modelos de IA saírem de controle e invadirem plataforma

Empresa disse que episódio durante testes internos de segurança foi 'sem precedentes'

22 jul 2026 - 08h43
(atualizado às 08h59)

A OpenAI, empresa responsável pelo desenvolvimento do ChatGPT, informou que modelos avançados de inteligência artificial (IA) apresentaram um comportamento inesperado durante testes internos de segurança, realizando de forma autônoma um ataque cibernético contra a plataforma Hugging Face, uma biblioteca digital de tecnologia de IA popular entre desenvolvedores.

Empresa abriu investigação após ataque contra Hugging Face
Empresa abriu investigação após ataque contra Hugging Face
Foto: ANSA / Ansa - Brasil

A empresa, sediada em São Francisco, classificou o episódio como um "incidente cibernético sem precedentes" e anunciou que conduzirá uma investigação conjunta com a Hugging Face para apurar as circunstâncias do ocorrido.

Publicidade

De acordo com a companhia, o incidente envolveu uma combinação de modelos de IA, incluindo o recém-lançado GPT-5.6 Sol e outro modelo experimental ainda em fase de pré-lançamento.

Os sistemas estavam sendo avaliados em um ambiente digital isolado, criado especificamente para testar suas capacidades de invasão em condições controladas e sem acesso à internet.

Em publicação em seu blog, a OpenAI afirmou que os modelos utilizaram grande capacidade computacional na tentativa de encontrar uma forma de escapar das restrições impostas pelo ambiente de testes.

Após conseguirem acesso à internet, os sistemas decidiram atacar a Hugging Face em busca de informações que pudessem ajudá-los a superar os desafios da avaliação.

Publicidade

Ainda segundo a empresa, os modelos encadearam diversos vetores de ataque, incluindo o uso de credenciais roubadas, para acessar informações consideradas estratégicas durante o teste.

A OpenAI ressaltou que o objetivo da simulação era justamente avaliar os riscos associados a agentes de inteligência artificial ? modelos capazes de executar tarefas de maneira autônoma no mundo real.

Para Hussein Abbass, professor de Ciência da Computação da UNSW Canberra, o episódio é "inacreditável em muitos aspectos". Em entrevista à AFP, o pesquisador afirmou que o sistema não se limitou a atacar a Hugging Face, mas também tentou explorar vulnerabilidades em sua própria infraestrutura. "Isso é assustador", declarou.  

Curtiu? Fique por dentro das principais notícias através do nosso ZAP
Inscreva-se