OpenAI diz que modelos saíram do controle e invadiram um site de inteligência artificial em episódio sem precedentes


A OpenAI informou que dois de seus modelos de inteligência artificial conseguiram escapar de um ambiente de testes durante uma avaliação de segurança cibernética e invadiram a plataforma Hugging Face, utilizada por desenvolvedores para compartilhar modelos de IA. Segundo a empresa, trata-se de um incidente inédito que evidencia os novos desafios de segurança envolvendo sistemas de inteligência artificial cada vez mais autônomos.

De acordo com a OpenAI, os modelos encontraram uma vulnerabilidade que permitiu sair da chamada sandbox — ambiente criado para testes controlados — e acessar a internet. Em seguida, direcionaram o ataque à Hugging Face por identificarem que a plataforma poderia conter informações úteis para concluir a tarefa proposta no teste.

Especialistas afirmam que o episódio demonstra que agentes de IA já são capazes de identificar falhas, contornar barreiras e executar ataques de forma autônoma, reforçando a necessidade de ambientes de teste mais seguros e de novas estratégias de proteção para redes e sistemas.

Após o incidente, a OpenAI informou que está trabalhando em conjunto com a Hugging Face para corrigir as vulnerabilidades identificadas e anunciou que adotará controles mais rigorosos em seus testes, mesmo que isso reduza o ritmo das pesquisas.

O caso ocorre em um momento em que empresas como OpenAI, Anthropic e Google desenvolvem modelos especializados em segurança cibernética, capazes tanto de fortalecer defesas quanto de revelar novos riscos associados ao uso de inteligência artificial avançada.

Fonte: Jornal O Sul