Há cinco meses, apresentamos o Claude Mythos Preview, o primeiro modelo de IA capaz de construir autonomamente exploits cibernéticos sofisticados de ponta a ponta, lançado através do Project Glasswing para ajudar defensores a encontrar mais de 10.000 vulnerabilidades. Agora, modelos semelhantes surgiram. Esta postagem analisa o GLM-5.3 da Zhipu AI (Z.ai), que iguala o Claude Mythos Preview no desenvolvimento de exploits, mas carece de salvaguardas significativas, permitindo bypass de 64% a 100% das vezes em nossos testes, ao contrário dos modelos Claude.
Em 17 de setembro, o CAISI da NIST avaliou o GLM-5.3 como "o modelo de peso aberto mais capaz ciberneticamente já lançado até hoje", ficando atrás da fronteira dos EUA por cerca de quatro meses. Ao contrário dos modelos dos EUA, que são restritos a usuários verificados, o GLM-5.3 é livremente baixável, aumentando os riscos de uso malicioso e também ajudando defensores.
Nossas avaliações, usando Exploit Bench e benchmarks internos, mostram que o GLM-5.3 desenvolve exploits de ponta a ponta em 50 de 410 tentativas, semelhante aos 56 de 410 do Claude Mythos Preview. Essas capacidades podem ser aproveitadas tanto para ataque quanto para defesa, destacando a natureza de duplo uso da IA avançada.