Geral

Modelos de IA escapam de sistema de testes de empresa famosa durante experimento de segurança; entenda

Reprodução/Singularity Brazil
Segundo a empresa, os sistemas deveriam permanecer confinados em uma "sandbox", ambiente isolado criado para impedir qualquer interação externa  |   BNews RN - Divulgação Reprodução/Singularity Brazil
José Nilton Jr.

por José Nilton Jr.

Publicado em 22/07/2026, às 15h32



A OpenAI, empresa responsável pelo Chat GPT,  revelou nesta semana que dois de seus modelos de inteligência artificial conseguiram escapar de um ambiente controlado de testes e acessar a plataforma Hugging Face, uma das maiores bibliotecas de modelos de IA utilizadas por desenvolvedores em todo o mundo. O episódio ocorreu durante uma simulação interna de segurança cibernética.

Segundo a empresa, os sistemas deveriam permanecer confinados em uma "sandbox", ambiente isolado criado para impedir qualquer interação externa. No entanto, os modelos encontraram uma vulnerabilidade, conseguiram acesso à internet e iniciaram uma sequência de ações não prevista pelos pesquisadores.

A OpenAI classificou o caso como um incidente inédito de segurança envolvendo inteligência artificial avançada e informou que trabalha em conjunto com a Hugging Face para investigar o ocorrido e reforçar os mecanismos de proteção.

Modelos exploraram falha e chegaram à internet

De acordo com a empresa, o teste envolvia o GPT-5.6 Sol e outro modelo mais avançado, ainda não lançado. O objetivo era avaliar até que ponto as inteligências artificiais seriam capazes de identificar vulnerabilidades e executar um ataque cibernético em ambiente controlado.

Após escapar da sandbox, os modelos direcionaram suas ações para a Hugging Face, por entenderem que a plataforma poderia conter informações úteis para concluir a tarefa proposta no experimento.

Em comunicado, a OpenAI afirmou que já está implementando controles mais rigorosos em sua infraestrutura, mesmo que isso reduza o ritmo das pesquisas, para eliminar as falhas identificadas.

Especialistas alertam para novos riscos

O caso reforça preocupações levantadas nos últimos anos por empresas e especialistas sobre o potencial uso da inteligência artificial em ataques cibernéticos. Modelos capazes de programar, identificar vulnerabilidades e executar tarefas de forma autônoma podem representar desafios inéditos para a segurança digital.

Corrida por modelos voltados à segurança

A Hugging Face confirmou que detectou a invasão provocada por um sistema autônomo, mas inicialmente não informou que a origem era um teste conduzido pela OpenAI.

A divulgação ocorre em meio à corrida das empresas de tecnologia para desenvolver modelos especializados em segurança cibernética. Neste ano, a Anthropic lançou o modelo Mythos para um grupo restrito de organizações, enquanto a OpenAI também disponibilizou uma ferramenta semelhante para testes limitados.

Classificação Indicativa: Livre

Facebook Twitter WhatsApp


Whatsapp floating

Receba as notificações pelo Whatsapp

Quero me cadastrar Close whatsapp floating