OpenAI diz que modelo de IA saiu do controle durante testes
Agente conseguiu burlar controle e acessar internet para invadir sistema de startup e atingir o objetivo; OpenAI fala em episódio "sem precedentes"
SBT News, com informações da Reuters
OpenAI | Getty Images
A OpenAI afirmou nesta terça-feira (21) que parte de seus modelos de inteligência artificial saiu do controle durante um teste de segurança e provocou um ataque digital que comprometeu a infraestrutura da startup de IA Hugging Face, que hospeda modelos de código aberto e recursos de teste, na semana passada.
Acompanhe o SBT News nas TVs por assinatura Claro (586), Vivo (576), Sky (580) e Oi (175), via streaming pelo +SBT, Site e YouTube, além dos canais nas Smart TVs Samsung e LG.
A empresa explicou em comunicado que estava testando as capacidades de alguns de seus modelos mais avançados em um ambiente controlado, mas que eles conseguiram escapar do isolamento, acessar a internet e invadir a Hugging Face para tentar atingir o objetivo do teste. O agente responsável pelo episódio foi o GPT-5.6 Sol, assim como um modelo mais poderoso e ainda não lançado.
O comunicado descreveu a fuga como “um incidente cibernético sem precedentes, envolvendo recursos de última geração” e afirmou que, passado o episódio, está reforçando suas medidas de segurança.
Os modelos estavam sendo testados em relação a uma avaliação padrão de cibersegurança gratuita chamada ExploitGym. De acordo com a OpenAI, os modelos inferiram corretamente que as soluções para esse teste eram mantidas pela Hugging Face.
"Os modelos identificaram e encadearam vulnerabilidades no ambiente de pesquisa da OpenAI e na infraestrutura de produção da Hugging Face para obter soluções de teste diretamente do banco de dados de produção da Hugging Face [...] Todas as evidências sugerem que os modelos estavam hiperfocados em encontrar uma solução para o ExploitGym, chegando a extremos para atingir um objetivo de teste bastante específico", disse a empresa em nota.
A Hugging Face, uma plataforma usada para hospedar grandes modelos de linguagem e conjuntos de dados de código aberto, causou apreensão na comunidade de segurança digital ao anunciar na semana passada que havia sido alvo de um ataque eletrônico "diferente de tudo o que já havíamos enfrentado antes”, na medida em que “foi conduzido, do início ao fim, por um sistema autônomo de agentes de IA”.
A revelação da OpenAI de que seus modelos avançados foram responsáveis pela violação, apesar de tê-los colocado no que descreveu como “um ambiente altamente isolado”, intensifica a inquietação em relação ao poder e ao risco dos modelos de IA mais sofisticados.
OpenAI diz que modelo de IA saiu do controle durante testesAgente conseguiu burlar controle e acessar internet para invadir sistema de startup e atingir o objetivo; OpenAI fala em episódio "sem precedentes"Mundo2026-07-21T23:33:53.478ZA OpenAI afirmou nesta terça-feira (21) que parte de seus modelos de inteligência artificial saiu do controle durante um teste de segurança e provocou um ataque digital que comprometeu a infraestrutura da startup de IA, que hospeda modelos de código aberto e recursos de teste, na semana passada. A empresa explicou em comunicado que estava testando as capacidades de alguns de seus modelos mais avançados em um ambiente controlado, mas que eles conseguiram escapar do isolamento, acessar a internet e invadir a Hugging Face para tentar atingir o objetivo do teste. O agente responsável pelo episódio foi o GPT-5.6 Sol, assim como um modelo mais poderoso e ainda não lançado. O descreveu a fuga como “um incidente cibernético sem precedentes, envolvendo recursos de última geração” e afirmou que, passado o episódio, está reforçando suas medidas de segurança. Os modelos estavam sendo testados em relação a uma avaliação padrão de cibersegurança gratuita chamada ExploitGym. De acordo com a OpenAI, os modelos inferiram corretamente que as soluções para esse teste eram mantidas pela Hugging Face. "Os modelos identificaram e encadearam vulnerabilidades no ambiente de pesquisa da OpenAI e na infraestrutura de produção da Hugging Face para obter soluções de teste diretamente do banco de dados de produção da Hugging Face [...] Todas as evidências sugerem que os modelos estavam hiperfocados em encontrar uma solução para o ExploitGym, chegando a extremos para atingir um objetivo de teste bastante específico", disse a empresa em nota. A Hugging Face, uma plataforma usada para hospedar grandes modelos de linguagem e conjuntos de dados de código aberto, causou apreensão na comunidade de segurança digital ao anunciar na semana passada que havia sido alvo de um ataque eletrônico "diferente de tudo o que já havíamos enfrentado antes”, na medida em que “foi conduzido, do início ao fim, por um sistema autônomo de agentes de IA”. A revelação da OpenAI de que seus modelos avançados foram responsáveis pela violação, apesar de tê-los colocado no que descreveu como “um ambiente altamente isolado”, intensifica a inquietação em relação ao poder e ao risco dos modelos de IA mais sofisticados. São PauloSPSudestehttps://sbtnews.sbt.com.br/noticia/mundo/open-ai-diz-que-modelo-de-ia-saiu-do-controle-durante-testes
Zelensky anuncia troca no comando militar após protestos
Presidente da Ucrânia nomeia general de 43 anos para liderar as Forças Armadas após mudanças no governo e pressão por estratégias no conflito com a Rússia
França aprova proibir redes sociais a menores de 15 anos
Senado e Câmara deram aval ao projeto que restringe acesso a plataformas e bane celulares em escolas; França será a primeira na União Europeia a adotar medida