Dois modelos de inteligência artificial (IA) da OpenAI conseguiram escapar do seu ambiente de testes, aceder à Internet e violar as defesas da plataforma Hugging Face, conforme a própria empresa reconheceu no seu blogue.
A OpenAI, dona do ChatGPT, confirmou na terça-feira que os seus modelos avançados de IA tinham agido por conta própria durante testes de segurança, invadindo, por sua iniciativa, uma plataforma popular entre programadores.
Sediada em São Francisco, EUA, a tecnológica descreveu o ocorrido como um “incidente cibernético sem precedentes” e anunciou uma investigação conjunta com a Hugging Face, plataforma colaborativa e de código aberto focada em inteligência artificial e machine learning.
A OpenAI explicou que o incidente envolveu uma combinação de modelos, incluindo o recém-lançado GPT-5.6 Sol e um modelo “ainda mais capaz”, atualmente em desenvolvimento.
“Ao operarem no nosso ambiente de teste isolado (sandbox), os modelos dedicaram uma quantidade significativa [de poder computacional] para encontrar uma maneira de obter acesso irrestrito à internet com o objetivo de resolver o problema da avaliação”, afirmou a OpenAI numa publicação no blog que detalhava o incidente.
Na visão da OpenAI, este é um incidente cibernético “sem precedentes” que envolve recursos de cibersegurança de vanguarda.
“Estamos a partilhar estas descobertas preliminares nesta fase para ajudar as equipas de defesa a compreender o que aconteceu e avaliar o alcance dos recursos atuais dos modelos”, explicou a OpenAI.
A tecnológica vai continuar a sua investigação em colaboração com a Hugging Face e partilhará suas conclusões assim que estiver concluída.