HeadlinesBriefing favicon HeadlinesBriefing.com

OpenAI तृतीय-पक्ष मूल्यांकन सिद्धांत

OpenAI Blog •
×

फ्रंटियर AI लैब्स मॉडलों को सुरक्षित रूप से प्रशिक्षित करने, मूल्यांकन करने और तैनात करने में एक विशाल जिम्मेदारी वहन करती हैं। तृतीय-पक्ष मूल्यांकन उस जिम्मेदारी को संतुलित करने, AI सुरक्षा पर इनपुट के अवसरों का विस्तार करने, दुनिया को सूचित रखने और लैब्स को स्पष्ट और स्वतंत्र रूप से समर्थित सुरक्षा दावों के प्रति जवाबदेह बनाए रखने का एक महत्वपूर्ण हिस्सा हैं। फ्रंटियर की गति बनाए रखने के अपने प्रयासों के एक हिस्से के रूप में, OpenAI प्रशिक्षण, मूल्यांकन और तैनाती में गहन स्तर की पहुंच के साथ स्वतंत्र मूल्यांकन का समर्थन करने के लिए प्रतिबद्ध है। उस पहुंच को मूल्यांकनकर्ताओं को हमारी धारणाओं को चुनौती देने, हमारी छूटी हुई जोखिमों की पहचान करने और हमारे सुरक्षा उपायों की प्रभावशीलता के बारे में अपने स्वयं के निष्कर्ष निकालने में सक्षम बनाना चाहिए।

हम लंबे समय से मॉडल विकास और तैनाती प्रक्रिया के विभिन्न चरणों में तृतीय-पक्ष मूल्यांकनकर्ताओं के साथ काम कर रहे हैं। हमने तृतीय-पक्ष मूल्यांकन को अपनी तैयारी ढांचा प्रथाओं में भी शामिल किया है और उन संगठनों और कानून का समर्थन किया है जो अधिक कठोर और जवाबदेह प्रक्रिया की वकालत करते हैं। इन सहयोगों के दौरान, हमने पहुंच के गहन रूप प्रदान किए हैं, जिनमें हमारे तकनीकी सुरक्षा उपायों के बारे में जानकारी, दृश्य चिंतन श्रृंखला पहुंच, और घटना प्रतिक्रिया और निगरानी रेड टीमिंग के लिए अभूतपूर्व स्तर के गोपनीय डेटा और आंतरिक तैनाती पहुंच शामिल हैं। यहां साझा की गई प्राथमिकताएं और सिद्धांत तकनीकी सुरक्षा मूल्यांकन पर निजी और गैर-लाभकारी क्षेत्र में स्वतंत्र मूल्यांकन संगठनों के साथ हमारे जुड़ाव पर केंद्रित हैं। वे परीक्षण और मूल्यांकन पर सरकारों के साथ हमारे काम के पूरक हैं, जहां अलग-अलग भूमिकाओं और जिम्मेदारियों के लिए अलग-अलग दृष्टिकोण की आवश्यकता हो सकती है।

इन मूल्यांकनों को प्रभावी बनाने के लिए मजबूत स्वतंत्रता तंत्र, वैज्ञानिक कठोरता, मजबूत सुरक्षा प्रथाओं और स्पष्ट जिम्मेदारियों की आवश्यकता होती है। लैब्स की जिम्मेदारी है कि वे संवेदनशील जानकारी की सुरक्षा करते हुए सार्थक जांच को सक्षम बनाएं। लैब्स और स्वतंत्र मूल्यांकनकर्ता इसे सही करने की जिम्मेदारी साझा करते हैं, और उन्हें सुरक्षा और संरक्षा प्रथाओं के लिए साझा अंतर्राष्ट्रीय मानकों के साथ काम करना चाहिए। नीचे, हम गहन मूल्यांकन के लिए चार प्राथमिकता क्षेत्रों का प्रस्ताव करते हैं, साथ ही कठोर, सुरक्षित और स्वतंत्र काम के सिद्धांतों का भी।

मूल्यांकन के लिए प्राथमिकता क्षेत्र: तृतीय-पक्ष मूल्यांकन तब सबसे उपयोगी होते हैं जब वे विशिष्ट, महत्वपूर्ण प्रश्नों को संबोधित करते हैं: क्या साक्ष्य एक लैब के सुरक्षा मामले और सुरक्षा दावों का समर्थन करते हैं? क्या मूल्यांकन उन जोखिमों का पर्याप्त परीक्षण करते हैं जिन्हें वे मापने के लिए हैं? क्या सुरक्षा उपाय वास्तविक परिस्थितियों में काम करते हैं? यहां वर्णित मूल्यांकन जांच किए जा रहे सुरक्षा प्रश्नों के आधार पर अलग-अलग रूप लेने के लिए हैं। हम विभिन्न समयावधियों में समानांतर रूप से कई मूल्यांकनों का समर्थन करने की उम्मीद करते हैं, कुछ हफ्तों तक चलने वाले और कुछ कई महीनों तक। जबकि तृतीय-पक्ष मूल्यांकन तैनाती-पूर्व काम का हिस्सा भी हो सकते हैं और तैनाती निर्णयों को सूचित कर सकते हैं, यहां वर्णित काम आम तौर पर दीर्घकालिक और लॉन्च-अज्ञेयवादी है—समय के साथ विशेष सुरक्षा दावों की गहराई से जांच पर केंद्रित। हमारे प्राथमिकता क्षेत्रों और सिद्धांतों में, हम सुरक्षा दावों और सुरक्षा मामलों का उल्लेख करते हैं। इन शब्दों से हमारा क्या मतलब है, वह निम्नलिखित है: हम गहन मूल्यांकन के लिए चार प्राथमिकता क्षेत्रों का प्रस्ताव करते हैं, साथ ही कठोर, सुरक्षित और स्वतंत्र काम के सिद्धांतों का भी। सुरक्षा मामलों का स्वतंत्र मूल्यांकन, जिसमें प्रशिक्षण, मूल्यांकन, आंतरिक तैनाती और बाहरी तैनाती शामिल हैं। सुरक्षा मामलों के मूल्यांकन के लिए संरेखण, निगरानी जैसे नियंत्रण विधियों, साइबर सुरक्षा, जैविक और रासायनिक दुरुपयोग और रेड टीमिंग में विशेषज्ञता की आवश्यकता होती है। सुरक्षा मामलों में प्रशिक्षण, क्षमता मूल्यांकन और सुरक्षा उपायों सहित दावे शामिल होते हैं, जिनका मूल्यांकन पूरे या भागों में किया जा सकता है (नीचे प्राथमिकताएं 2 और 3 देखें)। कई मूल्यांकनकर्ताओं को अपनी-अपनी विशेषज्ञता के आधार पर मामलों के विभिन्न हिस्सों की जांच करने की आवश्यकता हो सकती है। साथ में, उनके मूल्यांकन को ऐसे प्रश्नों का उत्तर देना चाहिए: क्या प्रशिक्षण, मूल्यांकन और तैनाती के सुरक्षा मामलों के साक्ष्य प्रमाणित हैं? क्या प्रशिक्षण, मूल्यांकन के दौरान सुरक्षा मामले की शर्तों का पालन किया गया...

FAQ प्रश्न: तृतीय-पक्ष मूल्यांकन के लिए OpenAI की प्राथमिकताएं क्या हैं?

FAQ उत्तर: OpenAI गहन मूल्यांकन के लिए चार प्राथमिकता क्षेत्रों का प्रस्ताव करता है, साथ ही कठोर, सुरक्षित और स्वतंत्र काम के सिद्धांतों का भी। इनमें प्रशिक्षण, मूल्यांकन, आंतरिक तैनाती और बाहरी तैनाती तक फैले सुरक्षा मामलों का स्वतंत्र मूल्यांकन शामिल है।