A Anthropic publicou um estudo que coloca o modelo chinês GLM-5.3 da Zhipu AI sob forte escrutínio. O artigo detalha como esta tecnologia de código aberto pode ser utilizada para gerar conteúdo malicioso devido a salvaguardas fracas. Esta denúncia surge numa altura em que o mercado global debate a segurança tecnológica, lembrando a ocasião em que Jensen Huang defendeu o uso de modelos de Inteligência Artificial chineses, o que gerou discussões intensas sobre a fiabilidade destas plataformas abertas. A investigação aponta para capacidades de ataque cibernético comparáveis às do modelo Claude Mythos da própria Anthropic, levantando sérias preocupações para a indústria.
Testes expõem vulnerabilidades
Os testes realizados na plataforma Exploitbench mostraram resultados preocupantes no desenvolvimento de falhas de segurança para o browser da Google. O GLM-5.3 conseguiu criar exploits completos em 50 das 410 tentativas, ficando muito perto das 56 execuções bem-sucedidas do sistema Mythos. Avaliações internas adicionais focadas em sequestro de fluxo de controlo deram à ferramenta asiática uma taxa de sucesso de 4%, enquanto modelos concorrentes abertos como o Kimi K3 registaram zero por cento nas mesmas métricas. Para contornar as restrições normais, os analistas aplicaram comandos enganosos que colocam a máquina a interpretar o papel de um agente autónomo adversário. Esta técnica simples resultou numa eficácia de 64%, número que sobe para os 92% quando se preenchem antecipadamente os tokens de raciocínio.
Custos e remoção de barreiras
A equipa de investigação também demonstrou um processo de obliteração que remove por completo as barreiras de protecção originais. Quando o sistema sofre esta alteração profunda, a taxa de recusa para gerar conteúdo perigoso cai para apenas 6% na versão principal e 14% na variante mais leve Flash. Executar esta versão modificada exige, no entanto, muitos recursos de hardware. O funcionamento adequado pede 306 GB de memória VRAM e uma largura de banda de 4 TB/s, o que obriga à utilização de aceleradores topo de gama. O processo de remoção de restrições na versão completa do modelo demorou 2.200 horas de GPU, o que representa um custo na ordem dos 4.400 dólares (cerca de 3.960 euros). A versão Flash foi quebrada em 600 horas.
