HeadlinesBriefing favicon HeadlinesBriefing.com

बच्चे AI से आगे सीखते हैं: डेटा दक्षता अंतर

MIT Technology Review AI •
×

LLMs को बच्चों की तुलना में भाषा सीखने के लिए बहुत अधिक डेटा की आवश्यकता होती है। इसे समझने से हमें अधिक कुशल मॉडल बनाने में मदद मिल सकती है और विकसित हो रहे मन के बारे में अधिक जानकारी मिल सकती है।

लोगों ने कम से कम 100,000 वर्षों से एक-दूसरे से बात की है, जैसा कि हम बता सकते हैं। और इस पूरे समय में, दुनिया में केवल एक ही चीज थी जो मानव भाषा को पूर्ण धाराप्रवाह में सीख सकती थी: एक मानव बच्चा। अब दो हैं। [ADDRESS] के रिलीज़ के केवल चार साल बाद, हममें से कई अब इसे 당연 मानते हैं कि हम अपने फोन या कंप्यूटर के साथ प्राकृतिक रूप से बात कर सकते हैं।

[PERSON_NAME], [PERSON_NAME], और Open AI के GPT मॉडल जैसे LLMs इतनी धाराप्रवाह और लचीले हैं कि वे मनुष्यों के रूप में convincingly रूप में पेश आ सकते हैं। लेकिन कंप्यूटेशनल पर्दे के पीछे झांकने पर, एक पकड़ है: कंप्यूटर को मानव भाषा का उपयोग करना सिखाने में अभी भी एक असमान मात्रा में डेटा की आवश्यकता होती है। एक LLM आसानी से एक व्यक्ति द्वारा अपनी मातृभाषा में निपुण होने की प्रक्रिया में अनुभव किए जाने वाले शब्दों की तुलना में एक लाख गुना अधिक शब्द प्रोसेस कर सकता है — और तो और, बच्चों के पहले जन्मदिन पर जब वे आमतौर पर भाषा की समझ पकड़ना शुरू करते हैं, तब तक सुने गए शब्दों से भी बहुत अधिक।

हालिया प्रगति अद्भुत रही है, [PERSON_NAME], स्टैनफोर्ड विश्वविद्यालय में एक संज्ञानात्मक वैज्ञानिक, LLMs के बारे में कहते हैं। लेकिन हमें अभी भी एक जंगल जलाना पड़ता है और पूरे मानव ज्ञान के योग को खरच करना पड़ता है ताकि इस मील के पत्थर को फिर से बनाया जा सके जो हमारे रहने के कमरे में एक साल में होता है। बच्चों और मशीनों के बीच यह यawning अंतर डेटा दक्षता अंतर कहलाता है।

मुख्य संस्थाएं: कंपनियां: Open AI, Meta | लोग: [PERSON_NAME], [PERSON_NAME], [PERSON_NAME] | स्थान: स्टैनफोर्ड विश्वविद्यालय, जॉर्जटाउन विश्वविद्यालय

अक्सर पूछे जाने वाले प्रश्न: बच्चे अभी भी सबसे भाषाविद रूप से उन्नत मशीनों को कैसे outperforming कर सकते हैं जो कभी बनाई गईं?

अंतर डेटा दक्षता में है। बच्चे प्रीटीन उम्र तक लगभग 100 मिलियन शब्दों से भाषा सीखते हैं, जबकि LLMs ट्रिलियनों टोकन को प्रोसेस करते हैं। डेटा दक्षता अंतर बताता है कि बच्चे अंतर्निहित संज्ञानात्मक संरचनाओं या अधिक कुशल सीखने के तंत्र का उपयोग करते हैं जो AI ने अभी तक प्रतिकृत नहीं किया है।

अक्सर पूछे जाने वाला प्रश्न: बच्चे अभी भी सबसे भाषाविद रूप से उन्नत मशीनों को कैसे outperforming कर सकते हैं जो कभी बनाई गईं?

अक्सर पूछे जाने वाला उत्तर: अंतर डेटा दक्षता में है। बच्चे प्रीटीन उम्र तक लगभग 100 मिलियन शब्दों से भाषा सीखते हैं, जबकि LLMs ट्रिलियनों टोकन को प्रोसेस करते हैं। डेटा दक्षता अंतर बताता है कि बच्चे अंतर्निहित संज्ञानात्मक संरचनाओं या अधिक कुशल सीखने के तंत्र का उपयोग करते हैं जो AI ने अभी तक प्रतिकृत नहीं किया है।