HeadlinesBriefing HeadlinesBriefing.com

AI की “ना” कहने की क्षमता पर अधिक भरोसा

MIT Technology Review AI •
×

आज के बड़े भाषा मॉडल खतरनाक अनुरोधों को अस्वीकार करने के लिए डिज़ाइन किए जाते हैं, और यह सिद्धांत AI विकास में लगभग एक आज्ञा जैसा बन गया है। Anthropic का 2021 का ढांचा यह मानता था कि मॉडल सहायक, ईमानदार और सबसे बढ़कर हानिरहित होने चाहिए, और बम बनाने जैसे खतरनाक कार्यों में मदद से विनम्रतापूर्वक इनकार करें। फिर भी, इन प्रणालियों में अवज्ञा स्वाभाविक रूप से नहीं आती। अरबों वेब पृष्ठों पर प्रशिक्षित होने के कारण, एक मॉडल हिंसा और कड़वाहट की व्यापक समझ अवशोषित कर लेता है, लेकिन वह अपने आप यह नहीं सीखता कि उन शक्तियों को अपने तक कैसे सीमित रखे। स्टीवन एडलर, जिन्होंने 2020 से 2024 तक OpenAI में सुरक्षा पर काम किया, ने कहा कि कंपनी के शुरुआती मॉडल “किसी भी चीज़ के बारे में बकबक” करते थे।

आज, मॉडलों को बड़ी संख्या में अनुरोधों को अस्वीकार करने के लिए प्रशिक्षित किया जाता है। कंपनियां उन प्रश्नों को अस्वीकार करने के लिए प्रणालियों को पुरस्कृत करती हैं जिन्हें हानिकारक माना जाता है, और निर्दोष प्रश्नों को ज़रूरत से ज़्यादा अस्वीकार करने पर दंडित करती हैं, और अक्सर इन अभ्यासों को चलाने के लिए अन्य मॉडलों का उपयोग करती हैं। कुछ फर्में अपने मॉडलों को अतिरिक्त AI परतों के पीछे भी रखती हैं जो शरारती अनुरोधों को छानती हैं। फिर भी, इनकार अक्सर विफल हो जाता है, कभी-कभी हिंसक परिणामों के साथ। कुछ नवीनतम मॉडल कथित तौर पर महत्वपूर्ण नेटवर्कों में घुसपैठ करने में शीर्ष मानव हैकरों जितने कुशल हैं, और सार्वजनिक राय को विकृत करने में सबसे चालाक दुष्प्रचार करने वालों जितने प्रभावी।

चूंकि इनकार तंत्र संभाव्यता-आधारित हैं, इसलिए उनके पूरी तरह भरोसेमंद होने की संभावना कम है। दृढ़ उपयोगकर्ता पहले ही उन्हें तोड़ चुके हैं, और कंपनियां रिपोर्ट करती हैं कि उन्नत AI का उपयोग जैविक रोगाणुओं को परिष्कृत करने और स्वायत्त ड्रोन झुंड बनाने के प्रयास किए जा रहे हैं। इनकार पर निर्भरता का अर्थ यह भी है कि यह तय करना होगा कि मॉडल किस बात का पालन करे और किसे अस्वीकार करे, और इसके लिए कोई सूत्र नहीं है। विषाणु विज्ञानियों के पास खतरनाक विषाणुओं के अध्ययन के वैध कारण हो सकते हैं, और सुरक्षा शोधकर्ताओं को कमज़ोरियों की जांच करनी पड़ सकती है ताकि उन्हें ठीक किया जा सके। OpenAI के बोर्ड के सदस्य और AI परीक्षण कंपनी Gray Swan के सह-संस्थापक ज़िको कोल्टर कहते हैं कि यह रेखा कहां खींची जाए, यह एक बहुत बड़ा प्रश्न है।

फिलहाल, वह रेखा कहां हो, यह अकेले AI कंपनियां तय करती हैं, और वे ऐसा काफी गोपनीयता के साथ करती हैं। क्या समाज इस शक्ति के केंद्रीकरण को स्वीकार कर सकता है, भले ही अस्थायी रूप से, यह एक खुला प्रश्न बना हुआ है।

स्रोत: MIT Technology Review AI · HeadlinesBriefing द्वारा सारांशित