Modelos da OpenAI invadiram plataforma rival durante avaliação de segurança

Incidente envolveu GPT-5.6 Sol e outro modelo em pré-lançamento; Hugging Face confirmou que bancos de dados de parceiros não foram adulterados

Por
REUTERS/Kim Kyung-Hoon/File Photo

Uma inteligência artificial da OpenAI invadiu de forma autônoma o sistema da Hugging Face durante uma avaliação interna de cibersegurança. O episódio foi classificado pela própria OpenAI como um “ataque cibernético sem precedentes, envolvendo recursos cibernéticos de última geração”.

O comunicado foi publicado pela OpenAI em 21/07. Segundo a empresa, “após investigação, agora sabemos que esse incidente específico foi causado por uma combinação de modelos da OpenAI, incluindo o GPT-5.6 Sol e um modelo ainda mais capaz em versão pré-lançamento, todos com menos recusas cibernéticas para fins de avaliação, enquanto estavam sendo testados internamente em um benchmark de capacidades cibernéticas”.

Siga o canal da TMC no WhatsApp e receba as últimas notícias

Durante os testes, os modelos ficaram obcecados em encontrar as respostas do próprio teste. Foi nesse processo que a invasão ao sistema da Hugging Face ocorreu.

Hugging Face detectou antes da confirmação

O cofundador e CEO da Hugging Face, Clément Delangue, afirmou que a plataforma identificou a invasão na semana anterior ao comunicado da OpenAI. Segundo ele, “suspeitávamos que o ciberataque da semana passada pudesse ter vindo de um laboratório de ponta, dada a sofisticação do agente. E, de fato, veio mesmo”.

Delangue completou: “Este incidente, possivelmente o primeiro do gênero, comprova um ponto que sempre acreditamos: a segurança da IA ​​não será resolvida por uma única empresa trabalhando em segredo. Ela será resolvida de forma aberta, colaborativa, com amplo acesso à IA para todos os defensores, em todos os lugares”.

A Hugging Face confirmou que os bancos de dados de parceiros não sofreram adulteração.

O que a OpenAI disse sobre o incidente

A empresa também alertou que esse tipo de incidente deve se tornar mais comum “com a proliferação de modelos cada vez mais capazes em cibersegurança”. Segundo o comunicado, “a IA está acelerando a descoberta e a exploração de vulnerabilidades. A principal lição deste incidente é que a segurança dos modelos deve acompanhar o rápido avanço das capacidades”.

Próximos passos

A OpenAI se comprometeu a adotar controles mais rígidos na configuração da infraestrutura. A empresa também planeja aprimorar e adicionar proteções para treinamentos e avaliações futuras.

No comunicado, a OpenAI defendeu que “acreditamos que modelos avançados de cibersegurança precisam ajudar as equipes de segurança a encontrar vulnerabilidades antes dos atacantes, entender como elas podem ser encadeadas e corrigi-las na velocidade da máquina”.

Ao vivo
São Paulo
Ouça a TMC pelo Brasil
  • 100,1FM São Paulo
  • 101,3FM Rio de Janeiro
  • 100,3FM Curitiba
  • 88,7FM Belo Horizonte
  • 92,7FM Recife
  • 100,1FM Brasília
Notícias que importam para você
Copyright © 2026 CNPJ: 44.060.192/0001-05