OpenAI diz que modelo de IA saiu do controle durante testes
Agente conseguiu burlar controle e acessar internet para invadir sistema de startup e atingir o objetivo; OpenAI fala em episódio "sem precedentes"
SBT News, com informações da Reuters
OpenAI | Getty Images
A OpenAI afirmou nesta terça-feira (21) que parte de seus modelos de inteligência artificial saiu do controle durante um teste de segurança e provocou um ataque digital que comprometeu a infraestrutura da startup de IA Hugging Face, que hospeda modelos de código aberto e recursos de teste, na semana passada.
Acompanhe o SBT News nas TVs por assinatura Claro (586), Vivo (576), Sky (580) e Oi (175), via streaming pelo +SBT, Site e YouTube, além dos canais nas Smart TVs Samsung e LG.
A empresa explicou em comunicado que estava testando as capacidades de alguns de seus modelos mais avançados em um ambiente controlado, mas que eles conseguiram escapar do isolamento, acessar a internet e invadir a Hugging Face para tentar atingir o objetivo do teste. O agente responsável pelo episódio foi o GPT-5.6 Sol, assim como um modelo mais poderoso e ainda não lançado.
O comunicado descreveu a fuga como “um incidente cibernético sem precedentes, envolvendo recursos de última geração” e afirmou que, passado o episódio, está reforçando suas medidas de segurança.
Os modelos estavam sendo testados em relação a uma avaliação padrão de cibersegurança gratuita chamada ExploitGym. De acordo com a OpenAI, os modelos inferiram corretamente que as soluções para esse teste eram mantidas pela Hugging Face.
"Os modelos identificaram e encadearam vulnerabilidades no ambiente de pesquisa da OpenAI e na infraestrutura de produção da Hugging Face para obter soluções de teste diretamente do banco de dados de produção da Hugging Face [...] Todas as evidências sugerem que os modelos estavam hiperfocados em encontrar uma solução para o ExploitGym, chegando a extremos para atingir um objetivo de teste bastante específico", disse a empresa em nota.
A Hugging Face, uma plataforma usada para hospedar grandes modelos de linguagem e conjuntos de dados de código aberto, causou apreensão na comunidade de segurança digital ao anunciar na semana passada que havia sido alvo de um ataque eletrônico "diferente de tudo o que já havíamos enfrentado antes”, na medida em que “foi conduzido, do início ao fim, por um sistema autônomo de agentes de IA”.
A revelação da OpenAI de que seus modelos avançados foram responsáveis pela violação, apesar de tê-los colocado no que descreveu como “um ambiente altamente isolado”, intensifica a inquietação em relação ao poder e ao risco dos modelos de IA mais sofisticados.
OpenAI diz que modelo de IA saiu do controle durante testesAgente conseguiu burlar controle e acessar internet para invadir sistema de startup e atingir o objetivo; OpenAI fala em episódio "sem precedentes"Mundo2026-07-21T23:33:53.478ZA OpenAI afirmou nesta terça-feira (21) que parte de seus modelos de inteligência artificial saiu do controle durante um teste de segurança e provocou um ataque digital que comprometeu a infraestrutura da startup de IA, que hospeda modelos de código aberto e recursos de teste, na semana passada. A empresa explicou em comunicado que estava testando as capacidades de alguns de seus modelos mais avançados em um ambiente controlado, mas que eles conseguiram escapar do isolamento, acessar a internet e invadir a Hugging Face para tentar atingir o objetivo do teste. O agente responsável pelo episódio foi o GPT-5.6 Sol, assim como um modelo mais poderoso e ainda não lançado. O descreveu a fuga como “um incidente cibernético sem precedentes, envolvendo recursos de última geração” e afirmou que, passado o episódio, está reforçando suas medidas de segurança. Os modelos estavam sendo testados em relação a uma avaliação padrão de cibersegurança gratuita chamada ExploitGym. De acordo com a OpenAI, os modelos inferiram corretamente que as soluções para esse teste eram mantidas pela Hugging Face. "Os modelos identificaram e encadearam vulnerabilidades no ambiente de pesquisa da OpenAI e na infraestrutura de produção da Hugging Face para obter soluções de teste diretamente do banco de dados de produção da Hugging Face [...] Todas as evidências sugerem que os modelos estavam hiperfocados em encontrar uma solução para o ExploitGym, chegando a extremos para atingir um objetivo de teste bastante específico", disse a empresa em nota. A Hugging Face, uma plataforma usada para hospedar grandes modelos de linguagem e conjuntos de dados de código aberto, causou apreensão na comunidade de segurança digital ao anunciar na semana passada que havia sido alvo de um ataque eletrônico "diferente de tudo o que já havíamos enfrentado antes”, na medida em que “foi conduzido, do início ao fim, por um sistema autônomo de agentes de IA”. A revelação da OpenAI de que seus modelos avançados foram responsáveis pela violação, apesar de tê-los colocado no que descreveu como “um ambiente altamente isolado”, intensifica a inquietação em relação ao poder e ao risco dos modelos de IA mais sofisticados. São PauloSPSudestehttps://sbtnews.sbt.com.br/noticia/mundo/open-ai-diz-que-modelo-de-ia-saiu-do-controle-durante-testes
Redução da maioridade penal avança na Câmara nesta quarta
Comissão especial para analisar o tema será instalada à tarde; relator da proposta, deputado Mendonça Filho (PL-PE), diz que haverá votação antes das eleições
Ministro indicado por Motta turbina festejos na Paraíba
Em ano eleitoral, Ministério do Turismo priorizou repasses do São João para reduto do presidente da Câmara, que tenta se reeleger e eleger o pai para o Senado