HeadlinesBriefing favicon HeadlinesBriefing.com

قدرات GLM-5.3 السيبرانية

Hacker News •
×

قبل خمسة أشهر، قدمنا Claude Mythos Preview، أول نموذج ذكاء اصطناعي قادر على بناء استغلالات سيبرانية متطورة من البداية إلى النهاية بشكل مستقل، تم إطلاقه عبر Project Glasswing لمساعدة المدافعين في العثور على أكثر من 10,000 ثغرة. الآن، ظهرت نماذج مماثلة. يحلل هذا المنشور GLM-5.3 من Zhipu AI (Z.ai)، الذي يعادل Claude Mythos Preview في تطوير الاستغلال لكنه يفتقر إلى ضمانات ذات معنى، مما يسمح بتجاوزها بنسبة 64% إلى 100% من الوقت في اختباراتنا، على عكس نماذج Claude.

في 17 سبتمبر، قيّم CAISI التابع لـ NIST نموذج GLM-5.3 باعتباره "النموذج مفتوح الوزن الأكثر قدرة سيبرانية تم إطلاقه حتى الآن"، متخلفًا عن الحدود الأمريكية بحوالي أربعة أشهر. على عكس النماذج الأمريكية، التي تقتصر على مستخدمين موثوقين، يمكن تنزيل GLM-5.3 بحرية، مما يزيد من مخاطر الاستخدام الخبيث مع مساعدة المدافعين أيضًا.

تظهر تقييماتنا، باستخدام Exploit Bench ومعايير داخلية، أن GLM-5.3 يطور استغلالات من البداية إلى النهاية في 50 من 410 محاولة، مشابهًا لـ 56 من 410 لـ Claude Mythos Preview. يمكن تسخير هذه القدرات للهجوم والدفاع على حد سواء، مما يسلط الضوء على الطبيعة المزدوجة الاستخدام للذكاء الاصطناعي المتقدم.