HeadlinesBriefing favicon HeadlinesBriefing.com

GLM-5.3 সাইবার ক্ষমতা

Hacker News •
×

পাঁচ মাস আগে, আমরা Claude Mythos Preview চালু করেছি, প্রথম AI মডেল যা স্বায়ত্তশাসিতভাবে জটিল এন্ড-টু-এন্ড সাইবার শোষণ তৈরি করতে সক্ষম, Project Glasswing-এর মাধ্যমে প্রকাশিত যা প্রতিরক্ষাকারীদের 10,000-এরও বেশি দুর্বলতা খুঁজে পেতে সাহায্য করে। এখন, অনুরূপ মডেল আবির্ভূত হয়েছে। এই পোস্টটি Zhipu AI (Z.ai)-এর GLM-5.3 বিশ্লেষণ করে, যা শোষণ উন্নয়নে Claude Mythos Preview-এর সমান কিন্তু অর্থপূর্ণ সুরক্ষা ব্যবস্থার অভাব, আমাদের পরীক্ষায় 64% থেকে 100% সময় বাইপাসের অনুমতি দেয়, Claude মডেলের বিপরীতে।

17 সেপ্টেম্বর, NIST-এর CAISI GLM-5.3-কে "আজ পর্যন্ত প্রকাশিত সবচেয়ে সাইবার-সক্ষম ওপেন-ওয়েট মডেল" হিসেবে মূল্যায়ন করেছে, যা মার্কিন সীমান্ত থেকে প্রায় চার মাস পিছিয়ে। মার্কিন মডেলগুলির বিপরীতে, যা যাচাইকৃত ব্যবহারকারীদের মধ্যে সীমাবদ্ধ, GLM-5.3 অবাধে ডাউনলোডযোগ্য, দূষিত ব্যবহারের ঝুঁকি বাড়ায় এবং প্রতিরক্ষাকারীদেরও সহায়তা করে।

আমাদের মূল্যায়ন, Exploit Bench এবং অভ্যন্তরীণ বেঞ্চমার্ক ব্যবহার করে, দেখায় যে GLM-5.3 410 প্রচেষ্টার মধ্যে 50টিতে এন্ড-টু-এন্ড শোষণ বিকাশ করে, যা Claude Mythos Preview-এর 56-এর অনুরূপ। এই ক্ষমতাগুলি আক্রমণ এবং প্রতিরক্ষা উভয়ের জন্য ব্যবহার করা যেতে পারে, যা উন্নত AI-এর দ্বৈত-ব্যবহার প্রকৃতিকে তুলে ধরে।