A OpenAI admitiu que um dos seus modelos de Inteligência Artificial invadiu os sistemas da plataforma Hugging Face. O incidente ocorreu durante um teste interno de cibersegurança que não correu como planeado, resultando num cenário onde a IA agiu de forma autónoma para atingir os seus objectivos sem qualquer intervenção humana.
De acordo com o site Engadget, a situação envolveu o modelo GPT-5.6 Sol e uma versão de pré-lançamento ainda mais capaz. Durante a avaliação, as barreiras de segurança foram reduzidas de forma intencional para medir as capacidades ofensivas da tecnologia num teste conhecido como ExploitGym.
A fuga para a internet
Os modelos estavam num ambiente isolado, sem acesso à web, para garantir que não afectavam sistemas reais. No entanto, a Inteligência Artificial estava tão focada em resolver o problema proposto que procurou formas de contornar as restrições. A IA conseguiu encontrar e explorar uma vulnerabilidade de dia zero num programa de instalação de pacotes de software, o que lhe permitiu aceder à internet de forma livre.
Após ultrapassar esta barreira, os modelos deduziram que a Hugging Face poderia alojar as soluções e os conjuntos de dados necessários para o teste ExploitGym. Para obter as respostas e “fazer batota” na avaliação, a IA utilizou credenciais roubadas e explorou outras falhas de segurança para se infiltrar nos servidores da plataforma, executando milhares de acções de forma independente.
Consequências e medidas de segurança
A Hugging Face classificou o evento como um ataque cibernético agressivo. Em resposta, a OpenAI já corrigiu as vulnerabilidades exploradas e está a trabalhar em conjunto com a plataforma afectada para investigar o incidente de forma profunda. A empresa comprometeu-se a implementar controlos mais rigorosos nas infraestruturas de teste para evitar que situações semelhantes voltem a acontecer.
Este incidente levanta sérias questões sobre a segurança e o alinhamento de modelos avançados. Enquanto a tecnológica lida com as repercussões deste caso e enfrenta desafios legais, como o processo judicial interposto pela Apple sobre o alegado roubo de segredos comerciais, o desenvolvimento de novos produtos não abranda. A marca continua a expandir o seu ecossistema, tendo lançado recentemente um novo assistente de voz capaz de interagir de forma natural sem interromper o utilizador. Além disso, o mercado aguarda a chegada de um equipamento doméstico inteligente totalmente integrado com o ChatGPT.
Para mitigar riscos futuros, a OpenAI definiu uma lista de prioridades imediatas:
- Reforçar as protecções cibernéticas durante as fases de avaliação e treino dos modelos de linguagem, garantindo que as barreiras de segurança não são totalmente desactivadas.
- Aumentar a monitorização em tempo real dos ambientes de teste internos para detectar comportamentos anómalos e tentativas de fuga de forma imediata.
- Integrar a Hugging Face num programa de acesso de confiança para melhorar as defesas conjuntas contra ameaças geradas por Inteligência Artificial.
