HeadlinesBriefing favicon HeadlinesBriefing.com

OpenAI ने 6 चिंताजनक घटनाओं का खुलासा किया, नया रिपोर्टिंग फ्रेमवर्क लॉन्च किया

Financial Times Companies •
×

OpenAI ने अपने AI मॉडलों द्वारा "चिंताजनक व्यवहार" के एक बैच का खुलासा किया है और ऐसी घटनाओं को ट्रैक और रिपोर्ट करने के लिए एक नया फ्रेमवर्क स्थापित किया है, क्योंकि उद्योग प्रौद्योगिकी की सुरक्षा पर गहराते भय से जूझ रहा है। कंपनी ने खुलासा किया कि इसके फ्लैगशिप मॉडल, जिसे GPT-5.6 Sol के नाम से जाना जाता है, साथ ही अन्य मॉडल जो अभी जारी नहीं किए गए हैं, पिछले छह महीनों में "अप्रत्याशित या चिंताजनक" व्यवहार में लगे हुए थे। सैन फ्रांसिस्को स्थित कंपनी ने बुधवार को कहा कि छह घटनाओं में मॉडलों द्वारा "सामान्य बाधाओं" को नजरअंदाज करने के तरीके विकसित करना, डेटा गढ़ना और गलत ढंग से प्रस्तुत करना, और कार्यों का संचालन करते समय की गई गलतियों को छिपाना शामिल था।

ये नए खुलासे हाल के महीनों में घटनाओं की एक श्रृंखला के बाद आए हैं, जिसमें एक OpenAI एजेंट द्वारा AI स्टार्टअप Hugging Face को हैक करना शामिल है, जिसने प्रौद्योगिकी द्वारा उत्पन्न जोखिमों पर बढ़ती चिंता को जन्म दिया है। Anthropic के मुख्य कार्यकारी Dario Amodei, जो OpenAI के कट्टर प्रतिद्वंद्वी हैं, ने पिछले सप्ताहांत प्रौद्योगिकी के विकास को धीमा करने का आह्वान किया ताकि मनुष्यों के लिए इसके संभावित खतरे को बेहतर ढंग से प्रबंधित किया जा सके। इस आह्वान का समर्थन OpenAI के बॉस Sam Altman और Elon Musk ने किया।

एक ब्लॉग पोस्ट में छह घटनाओं की घोषणा करते हुए, OpenAI ने कहा कि उसने पहले अपने मॉडलों के दुराचार की घटनाओं का खुलासा करने की मांग की थी, लेकिन माना कि इसमें ऐसा करने के लिए एक "व्यवस्थित दृष्टिकोण" का अभाव था। "व्यवस्थित दृष्टिकोण के बिना इन निष्कर्षों की रिपोर्ट करने के लिए, हमारे खुलासे तदर्थ और आदर्श से कम बारंबार रहे हैं," इसने कहा। फिलहाल, कोई उद्योग-व्यापी फ्रेमवर्क नहीं है जिसमें AI डेवलपर्स के लिए उनके मॉडलों में मिसअलाइनमेंट के उदाहरणों का खुलासा कैसे करना चाहिए, इसके लिए स्पष्ट मानक हों।

कंपनी, जो AI में प्रमुख खिलाड़ी बनने के लिए Anthropic के साथ एक भयंकर दौड़ में लगी हुई है, ने कहा कि वह ऐसे घटनाओं के प्रकटीकरण को तेज करने के लिए एक फ्रेमवर्क पेश करेगी। इसने कहा कि इसकी नई प्रणाली "महत्व [एक घटना का] अनिश्चित होने पर भी प्रकटीकरण" का पक्ष लेगी। OpenAI के नवीनतम खुलासे AI प्रणालियों की सुरक्षा के बारे में गहराती चिंताओं को बढ़ाते हैं, जिनके दुराचार ऑनलाइन प्लेटफॉर्म पर दुर्भावनापूर्ण कोड डालने का प्रयास करने से लेकर वास्तविक दुनिया के हैक को उजागर करने तक रहे हैं, यहां तक कि पूर्व-तैनाती परीक्षण के दौरान भी।

यूके सरकार के फ्रंटियर AI सुरक्षा और सुरक्षा अनुसंधान निकाय के अनुसार, OpenAI और Anthropic के फ्लैगशिप AI मॉडलों ने पिछले महीने थर्ड-पार्टी सॉफ्टवेयर में सेंध लगाई और व्यक्तियों को उनकी क्रेडेंशियल चुराने के लिए ईमेल किया, जिससे अभूतपूर्व भ्रामक व्यवहार प्रदर्शित हुआ। ये भय OpenAI और Anthropic के लिए एक महत्वपूर्ण मोड़ पर आते हैं, जो सार्वजनिक होने की दौड़ में भी लगे हुए हैं। Altman ने शनिवार को कहा कि OpenAI का बहुप्रतीक्षित IPO अब 2027 से पहले आने की संभावना नहीं है, आंशिक रूप से AI के आसपास बढ़ती सुरक्षा चिंताओं के कारण। Anthropic के अभी भी इस साल सार्वजनिक होने की उम्मीद है।