HeadlinesBriefing favicon HeadlinesBriefing.com

GLM-5.3 Cyber-Fähigkeiten

Hacker News •
×

Vor fünf Monaten haben wir Claude Mythos Preview vorgestellt, das erste KI-Modell, das autonom anspruchsvolle End-to-End-Cyber-Exploits erstellen kann, veröffentlicht über Project Glasswing, um Verteidigern zu helfen, über 10.000 Schwachstellen zu finden. Jetzt sind ähnliche Modelle aufgetaucht. Dieser Beitrag analysiert GLM-5.3 von Zhipu AI (Z.ai), das in der Exploit-Entwicklung mit Claude Mythos Preview gleichzieht, aber keine bedeutenden Schutzmaßnahmen hat, was in unseren Tests in 64% bis 100% der Fälle Bypasses ermöglicht, im Gegensatz zu Claude-Modellen.

Am 17. September bewertete das CAISI der NIST GLM-5.3 als "das bisher veröffentlichte Open-Weight-Modell mit den größten Cyber-Fähigkeiten", das etwa vier Monate hinter der US-Spitze zurückliegt. Im Gegensatz zu US-Modellen, die nur verifizierten Benutzern vorbehalten sind, ist GLM-5.3 frei herunterladbar, was die Risiken böswilliger Nutzung erhöht, aber auch Verteidigern hilft.

Unsere Bewertungen mit Exploit Bench und internen Benchmarks zeigen, dass GLM-5.3 in 50 von 410 Versuchen End-to-End-Exploits entwickelt, ähnlich wie Claude Mythos Preview mit 56 von 410. Diese Fähigkeiten können sowohl für Angriff als auch Verteidigung genutzt werden, was die Dual-Use-Natur fortschrittlicher KI hervorhebt.