HeadlinesBriefing favicon HeadlinesBriefing.com

Astra मॉडल ने महत्वपूर्ण साइबर सुरक्षा क्षमता सीमा पार की

Hacker News •
×

हम अब मानते हैं कि Astra हमारे तैयार रहने के फ्रेमवर्क के तहत महत्वपूर्ण साइबर सुरक्षा क्षमता सीमा को पूरा करता है, जिसका अर्थ है कि यह मानव मार्गदर्शन के बिना कई अच्छी तरह से संरक्षित प्रणालियों में पहले अज्ञात सुरक्षा दोष खोज सकता है और उनका शोषण विकसित कर सकता है। यह वह पहला मॉडल है जिसे हम इस स्तर पर नामित कर रहे हैं, जिसकी विकास और रिलीज़ से पहले मजबूत सुरक्षा उपायों की आवश्यकता होती है। पिछले कुछ हफ्तों में, हमने Astra के विकास के कुछ हिस्सों को रोक दिया है ताकि साइबर दुरुपयोग और अनधिकृत मॉडल कार्यों के खिलाफ सुरक्षा को मजबूत किया जा सके। जबकि Astra Hugging Face घटना में शामिल नहीं था, हमने उस घटना से सीखे गए सबक को अपनी सुरक्षा दृष्टिकोण में शामिल कर लिया है। हमने Astra के लिए मजबूत सुरक्षा उपाय लागू किए हैं, जिसमें मॉडल को हानिकारक साइबर अनुरोधों को अधिक विश्वसनीय रूप से अस्वीकार करने के लिए प्रशिक्षित करना, दुरुपयोग के खिलाफ अतिरिक्त सुरक्षा, और संभावित रूप से अनधिकृत गतिविधि को रोकने के लिए निगरानी शामिल है। हम Astra को जल्द ही उपलब्ध कराने की योजना बना रहे हैं, लेकिन इसके सबसे उन्नत साइबर सुरक्षा क्षमताओं तक पहुंच अधिक सीमित होगी। उन्नत साइबर सुरक्षा कार्य शुरू में परीक्षकों के एक समूह के लिए उपलब्ध होगा, और Daybreak Blue के माध्यम से पहुंच के बाद इसका उपयोग रक्षात्मक उद्देश्यों के लिए विस्तारित किया जाएगा। हम मॉडल के सिस्टम कार्ड में लॉन्च के समय सुरक्षा, सुरक्षा और संरेखण परीक्षण के बारे में अधिक विवरण साझा करेंगे।

हमारे तैयार रहने के फ्रेमवर्क के तहत, एक मॉडल महत्वपूर्ण सीमा को पूरा करता है यदि वह मानव हस्तक्षेप के बिना कई सुदृढ़ वास्तविक दुनिया के महत्वपूर्ण प्रणालियों में सभी गंभीरता स्तरों के कार्यात्मक जीरो-डे एक्सप्लॉइंट्स की पहचान कर सकता है और उनका विकास कर सकता है, या केवल एक उच्च-स्तर के लक्ष्य दिए जाने पर कठोर लक्ष्यों के खिलाफ साइबर हमलों के लिए नए अंत-से-끝 रणनीतियों की योजना बना सकता है और उनका कार्यान्वयन कर सकता है। हमारे मूल्यांकन में स्वचालित सार्वजनिक और निजी बेंचमार्क के साथ विशेषज्ञ-आधारित मूल्यांकन का संयोजन किया गया। GPT‑5.6 Sol की तुलना में, Astra साइबर सुरक्षा क्षमताओं में महत्वपूर्ण वृद्धि दर्शाता है: यह न केवल बहुत अधिक टोकन-कुशल है, बल्कि कमजोरियों की पहचान और एक्सप्लॉइंट विकास में भी अधिक सक्षम है। Exploit Bench पर, Astra ने ज्ञात कमजोरियों से एक्सप्लॉइंट विकास का मूल्यांकन करने वाले बेंचमार्क पर पूर्ण 100% स्कोर हासिल किया। हाल ही में खुलासा किए गए 20 उच्च-गंभीरता V8 कमजोरियों वाले एक आंतरिक बेंचमार्क पर, Astra ने GPT‑5.6 Sol की तुलना में बहुत अधिक arbitrarily कोड-निष्पादन दर हासिल की, और यह बहुत कम आउटपुट टोकन का उपयोग करके किया। मूल्यांकन के दौरान, मॉडल ने एक एक्सप्लॉइंट चेन के हिस्से के रूप में दो जीरो-डे कमजोरियों की खोज और उपयोग किया, जिन्हें हम रखरखाव करने वालों को खुलासा कर रहे हैं। विशेषज्ञ-नेतृत्व वाले मूल्यांकन में एक सुदृढ़ ब्राउज़र और ऑपरेटिंग सिस्टम के खिलाफ, Astra ने पहले अज्ञात कमजोरियों की खोज की और उन्हें काम करने वाले एक्सप्लॉइंट चेन में बदल दिया, जिससे एक पूर्ण ब्राउज़र-कम्प्रोमाइज़ चेन बनी जो सैंडबॉक्स से बाहर निकल गई।

मुख्य इकाइयाँ: कंपनियाँ: Hugging Face

अक्सर पूछे जाने वाले प्रश्न: Astra के महत्वपूर्ण साइबर सुरक्षा क्षमता सीमा को पूरा करने का क्या अर्थ है?

महत्वपूर्ण सीमा को पूरा करने का अर्थ है कि Astra मानव हस्तक्षेप के बिना कई सुदृढ़ वास्तविक दुनिया के प्रणालियों में कार्यात्मक जीरो-डे एक्सप्लॉइंट्स की पहचान कर सकता है और उनका विकास कर सकता है, या केवल एक उच्च-स्तर के लक्ष्य दिए जाने पर कठोर लक्ष्यों के खिलाफ साइबर हमलों के लिए नए अंत-से-끝 रणनीतियों की योजना बना सकता है और उनका कार्यान्वयन कर सकता है, जैसा कि हमारे तैयार रहने के फ्रेमवर्क में परिभाषित किया गया है।