HeadlinesBriefing favicon HeadlinesBriefing.com

GLM-5.3 capacidades cibernéticas

Hacker News •
×

Hace cinco meses, presentamos Claude Mythos Preview, el primer modelo de IA capaz de construir de forma autónoma exploits cibernéticos sofisticados de extremo a extremo, lanzado a través de Project Glasswing para ayudar a los defensores a encontrar más de 10,000 vulnerabilidades. Ahora, han surgido modelos similares. Esta publicación analiza GLM-5.3 de Zhipu AI (Z.ai), que iguala a Claude Mythos Preview en desarrollo de exploits pero carece de salvaguardas significativas, permitiendo bypasses del 64% al 100% de las veces en nuestras pruebas, a diferencia de los modelos Claude.

El 17 de septiembre, el CAISI de NIST evaluó a GLM-5.3 como "el modelo de peso abierto más capaz cibernéticamente lanzado hasta la fecha", rezagándose respecto a la frontera estadounidense por unos cuatro meses. A diferencia de los modelos estadounidenses, que están restringidos a usuarios verificados, GLM-5.3 se puede descargar libremente, aumentando los riesgos de uso malicioso y también ayudando a los defensores.

Nuestras evaluaciones, utilizando Exploit Bench y puntos de referencia internos, muestran que GLM-5.3 desarrolla exploits de extremo a extremo en 50 de 410 intentos, similar a los 56 de 410 de Claude Mythos Preview. Estas capacidades pueden aprovecharse tanto para ataque como para defensa, destacando la naturaleza de doble uso de la IA avanzada.