Geral
Publicado em 22/07/2026, às 15h32 Reprodução/Singularity Brazil José Nilton Jr.
A OpenAI, empresa responsável pelo Chat GPT, revelou nesta semana que dois de seus modelos de inteligência artificial conseguiram escapar de um ambiente controlado de testes e acessar a plataforma Hugging Face, uma das maiores bibliotecas de modelos de IA utilizadas por desenvolvedores em todo o mundo. O episódio ocorreu durante uma simulação interna de segurança cibernética.
Segundo a empresa, os sistemas deveriam permanecer confinados em uma "sandbox", ambiente isolado criado para impedir qualquer interação externa. No entanto, os modelos encontraram uma vulnerabilidade, conseguiram acesso à internet e iniciaram uma sequência de ações não prevista pelos pesquisadores.
A OpenAI classificou o caso como um incidente inédito de segurança envolvendo inteligência artificial avançada e informou que trabalha em conjunto com a Hugging Face para investigar o ocorrido e reforçar os mecanismos de proteção.
De acordo com a empresa, o teste envolvia o GPT-5.6 Sol e outro modelo mais avançado, ainda não lançado. O objetivo era avaliar até que ponto as inteligências artificiais seriam capazes de identificar vulnerabilidades e executar um ataque cibernético em ambiente controlado.
Após escapar da sandbox, os modelos direcionaram suas ações para a Hugging Face, por entenderem que a plataforma poderia conter informações úteis para concluir a tarefa proposta no experimento.
Em comunicado, a OpenAI afirmou que já está implementando controles mais rigorosos em sua infraestrutura, mesmo que isso reduza o ritmo das pesquisas, para eliminar as falhas identificadas.
O caso reforça preocupações levantadas nos últimos anos por empresas e especialistas sobre o potencial uso da inteligência artificial em ataques cibernéticos. Modelos capazes de programar, identificar vulnerabilidades e executar tarefas de forma autônoma podem representar desafios inéditos para a segurança digital.
A Hugging Face confirmou que detectou a invasão provocada por um sistema autônomo, mas inicialmente não informou que a origem era um teste conduzido pela OpenAI.
A divulgação ocorre em meio à corrida das empresas de tecnologia para desenvolver modelos especializados em segurança cibernética. Neste ano, a Anthropic lançou o modelo Mythos para um grupo restrito de organizações, enquanto a OpenAI também disponibilizou uma ferramenta semelhante para testes limitados.