HeadlinesBriefing favicon HeadlinesBriefing.com

Capacités cybernétiques GLM-5.3

Hacker News •
×

Il y a cinq mois, nous avons présenté Claude Mythos Preview, le premier modèle d'IA capable de construire de manière autonome des exploits cybernétiques sophistiqués de bout en bout, publié via Project Glasswing pour aider les défenseurs à trouver plus de 10 000 vulnérabilités. Aujourd'hui, des modèles similaires ont émergé. Cet article analyse GLM-5.3 de Zhipu AI (Z.ai), qui égale Claude Mythos Preview dans le développement d'exploits mais manque de garde-fous significatifs, permettant des contournements de 64 % à 100 % du temps dans nos tests, contrairement aux modèles Claude.

Le 17 septembre, le CAISI de la NIST a évalué GLM-5.3 comme « le modèle open-weight le plus cyber-capable jamais publié à ce jour », en retard d'environ quatre mois sur la frontière américaine. Contrairement aux modèles américains, qui sont réservés aux utilisateurs vérifiés, GLM-5.3 est librement téléchargeable, augmentant les risques d'utilisation malveillante tout en aidant également les défenseurs.

Nos évaluations, utilisant Exploit Bench et des benchmarks internes, montrent que GLM-5.3 développe des exploits de bout en bout dans 50 des 410 tentatives, similaire aux 56 de Claude Mythos Preview. Ces capacités peuvent être exploitées à la fois pour l'attaque et la défense, soulignant la nature à double usage de l'IA avancée.