HeadlinesBriefing favicon HeadlinesBriefing.com

GLM-5.3 साइबर क्षमताएँ

Hacker News •
×

पाँच महीने पहले, हमने Claude Mythos Preview पेश किया, जो पहला AI मॉडल है जो स्वायत्त रूप से परिष्कृत एंड-टू-एंड साइबर शोषण बना सकता है, जिसे Project Glasswing के माध्यम से जारी किया गया ताकि रक्षकों को 10,000 से अधिक कमजोरियाँ खोजने में मदद मिल सके। अब, समान मॉडल सामने आए हैं। यह पोस्ट Zhipu AI (Z.ai) के GLM-5.3 का विश्लेषण करती है, जो शोषण विकास में Claude Mythos Preview के बराबर है लेकिन सार्थक सुरक्षा उपायों की कमी है, जिससे हमारे परीक्षणों में 64% से 100% समय बाईपास संभव है, Claude मॉडल के विपरीत।

17 सितंबर को, NIST के CAISI ने GLM-5.3 को "आज तक जारी सबसे साइबर-सक्षम ओपन-वेट मॉडल" के रूप में मूल्यांकन किया, जो अमेरिकी सीमा से लगभग चार महीने पीछे है। अमेरिकी मॉडलों के विपरीत, जो सत्यापित उपयोगकर्ताओं तक सीमित हैं, GLM-5.3 स्वतंत्र रूप से डाउनलोड करने योग्य है, जिससे दुर्भावनापूर्ण उपयोग के जोखिम बढ़ते हैं और रक्षकों की भी मदद होती है।

हमारे मूल्यांकन, Exploit Bench और आंतरिक बेंचमार्क का उपयोग करते हुए, दिखाते हैं कि GLM-5.3 410 प्रयासों में से 50 में एंड-टू-एंड शोषण विकसित करता है, जो Claude Mythos Preview के 56 के समान है। इन क्षमताओं का उपयोग हमले और बचाव दोनों के लिए किया जा सकता है, जो उन्नत AI की दोहरे उपयोग प्रकृति को उजागर करता है।