HeadlinesBriefing favicon HeadlinesBriefing.com

OpenAI AI एजेंट्स के साथ शोध को तेज कर रहा है

Hacker News •
×

एजीआई से पूरी मानवता को लाभ पहुंचाने के लिए, हमें लगता है कि इसे लोकतांत्रिक रूप से प्रशासित किया जाना चाहिए। यह केवल अत्यंत सक्षम AI प्रणालियों की क्षमताओं, जोखिम और सुरक्षा उपायों के बारे में जागरूक जनता की बहस के माध्यम से हो सकता है। दुनिया भर के लोगों को आगे के एआई के संभावित भविष्य के पथ को समझने की आवश्यकता है, ताकि वे इसके विकास में अर्थपूर्ण आवाज रख सकें। विशिष्ट जोखिम, घटनाओं और सुरक्षा उपायों के बारे में पारदर्शिता आवश्यक है, लेकिन पर्याप्त नहीं है। हमें विश्वास है कि सार्वजनिक को यह भी समझने की आवश्यकता है कि सबसे सक्षम प्रणालियां कैसे विकसित हो रही हैं, और वे फ्रंटियर प्रयोगशालाओं में शोध प्रगति को कैसे चला रही हैं। हम सुरक्षित रूप से एक स्वचालित एआई शोधकर्ता बनाना चाहते हैं जिसे मानव पर्यवेक्षण के तहत काम करने के लिए डिज़ाइन किया गया है, जिससे गहरी सीख और संरेखण में प्रगति होगी, जिससे परिक्रामी सुधार संभव होगा। हमारे माप के अनुसार, हमने अब तक लक्ष्य हासिल कर लिया है, जिसे पिछले年秋天 घोषित किया गया था, सितंबर तक स्वचालित शोधकर्ता इंटर्न का।" शोधकर्ता इंटर्न " द्वारा, हमारा मतलब एक ऐसी प्रणाली से है जिसे मानु निर्देशन के तहत अच्छी तरह से परिभाषित शोध कार्य करने के लिए डिज़ाइन किया गया है, जिसमें उन कार्य शामिल हैं जो एक कुशल शोधकर्ता को कुछ दिनों लगते हैं। हम मार्च 2028 तक स्वचालित एआई शोधकर्ता बनाने की दिशा में मजबूत प्रगति कर रहे हैं। इस वर्ष, OpenAI के शोधकर्ताओं का दैनिक कार्य काफी हद तक बदल गया है। शोधकर्ता पूरे दिन कोडिंग एजेंट का उपयोग कर रहे हैं (अक्सर समानांतर सत्रों में) और कुल उपयोग तेजी से बढ़ रहा है, अन्य OpenAI टीमों के बीच वृद्धि की तुलना में तेजी से। शोधकर्ता तेजी से कोड योगदान दे रहे हैं और अधिक प्रयोग चला रहे हैं। शोधकर्ताओं द्वारा एजेंट्स के उपयोग का तरीका भी बदल रहा है: एजेंट्स जटिल कार्य संभाल रहे हैं और उनमें सफलता अधिक बार मिल रही है। एआई शोध एक जटिल प्रक्रिया है जिसमें कई संभावित बॉटलनेक हो सकते हैं, इसलिए कुल मिलाकर प्रगति की गति शायद इन विशिष्ट मेट्रिक्स के साथ नहीं रख पाएगी। लेकिन कुल मिलाकर, ये खोजें हमारे कई आंतरिक लोगों द्वारा महसूस किए गए व्यापक प्रभाव के अनुरूप हैं कि एजेंट टूल वास्तव में शोध प्रगति को महत्वपूर्ण रूप से तेज कर रहे हैं। लोग अभी भी हमारे शोध प्राथमिकताओं को निर्धारित करते हैं, यह तय करते हैं कि कौन सी विचार और परिणामों का पursuit करना है, और यह तय करते हैं कि विस्तार करना है, रोकना है या प्रणालियों को तैनात करना है। यदि जिम्मेदारी से किया जाए, तो हमें विश्वास है कि स्वचालित एआई शोध से ऐसे मॉडल बनेंगे जो मानव कल्याण को सीधे बढ़ावा देंगे और OpenAI के मिशन को आगे बढ़ाएंगे। यह उन्नत बुद्धिमत्ता की लागत को कम कर सकता है ताकि दुनिया भर के लोग लाभ उठा सकें। हम इस काम का हिस्सा इसलिए कर रहे हैं क्योंकि स्वचालित शोध हमें संरेखण को हल करने और दिन में अधिक सक्षम AI एजेंट्स के खिलाफ बचाव करने में मदद कर सकता है। एक स्वचालित एआई शोधकर्ता एक स्वचालित सुरक्षा या संरेखण शोधकर्ता भी हो सकता है। अधिक सक्षम और संरेखित प्रणालियां महत्वपूर्ण बुनियादी ढांचे को सुरक्षित करने, खतरनाक एआई एजेंट्स का बचाव करने और नई सुरक्षा उपाय विकसित करने में मदद कर सकती हैं। इनका विकास उपयोगी स्वचालित शोध क्षमताओं के लिए कारण है, लेकिन इसका मतलब यह नहीं है कि तेज़ RSI (त्वरित स्व-प्रशिक्षण) एक ऐसा परिणाम है जिसे हमें perseguir करना चाहिए। चाहे कैसे भी आगे बढ़ना, हमारे मानव नियंत्रण को बनाए रखने की क्षमता और लाभ और जोखिम के बारे में सूचित लोकतांत्रिक विकल्पों पर निर्भर करता है। हम अभी तक सुरक्षित रूप से पूरी तरह से संरेखित RSI तक पहुंचने का तरीका नहीं जानते। हम संरक्षण और क्षमताओं के साथ पैमाने को बढ़ाने के लिए काम कर रहे हैं। लेकिन हम यह नहीं मान सकते कि संरक्षण और सुरक्षा में प्रगति क्षमता के साथ कदम मिलाए रखेगी, और अधिक सक्षम प्रणालियां निगरानी करना कठिन बन सकती हैं। सावधानीपूर्वक संरक्षण और सुरक्षा कार्य इस प्रयास के केंद्र में है, और यह आज एजेंट कोडिंग प्रणालियों में देखे गए सुरक्षा समस्याओं को मापने और mitigating से शुरू होता है। whenever हम पाते हैं कि आगे बढ़ना अस्वीकार्य सुरक्षा जोखिम पैदा करेगा, हम उचित रूप से जवाब देंगे, जिसमें उन प्रणालियों के विकास या तैनाती को धीमा करना या बंद करना शामिल है जो हमें पर्याप्त रूप से संरक्षित करने में असमर्थ पाते हैं। हाल के Hugging Face घटना के बाद, हमने इस प्रतिबद्धता को कार्रवाई में लाया, जबकि हम अपने शोध वातावरण को और अधिक कठोर और लाल टीम परीक्षण करते हैं, हमने पुनर्बलन सीखना (RL) प्रशिक्षण को हमारे तैनाती के लिए इरादा रखने वाले हमारे latest मॉडल पर रोक दिया है, और हमारे निगरानी प्रणालियों की कवरेज बढ़ा दी है।