HeadlinesBriefing favicon HeadlinesBriefing.com

শিশু AI-কে অতিক্রম করে: ডেটা দক্ষতার পার্থক্য

MIT Technology Review AI •
×

LLMs-কে শিশুদের চেয়ে ভাষা শেখার জন্য অসংখ্য বেশি ডেটার প্রয়োজন হয়। এটি বুঝতে পারলে আমরা আরও দক্ষ মডেল তৈরি করতে সাহায্য পayout এবং উন্নত হচ্ছে মনের বিষয়ে আরও জানা যাবে।

মানুষরা কমপক্ষে 100,000 বছর থেকে একে অপরের সাথে কথা বলছেন, যতটা আমরা বুঝতে পারি। এবং সেই সমস্ত সময়ে, বিশ্বে শুধুমাত্র একটি জিনিস ছিল যা মানব ভাষাকে সম্পূর্ণ দক্ষতায় শেখতে পারত: একজন মানব শিশু। এখন দুটি আছে। [ADDRESS] রিলিজের মাত্র চার বছর পর, আমাদের অনেকেই এখন স্বাভাবিকভাবে আমাদের ফোন বা কম্পিউটারের সাথে কথা বলতে পারি ಎಂದು মনে করি।

[PERSON_NAME], [PERSON_NAME], এবং Open AI-এর GPT মডেলের মতো LLMs খুব ধারাবাহিক এবং নমনীয়, যাতে তারা মানব convaincamente অনুকরণ করতে পারে। কিন্তু কম্পিউটেশনাল পর্দার পেছনে ঝাকলে, একটি ঝামেলা আছে: একটি কম্পিউটারকে মানব ভাষা ব্যবহার করা শেখাতে এখনও একটি অমানवीय পরিমাণ ডেটার প্রয়োজন হয়। একটি LLM সহজেই একটি ব্যক্তির মাতৃভাষা আয়ত্ত করার প্রক্রিয়ায় অভিজ্ঞ হওয়ার শব্দের চেয়ে এক লাখ গুণ বেশি শব্দ প্রক্রিয়া করতে পারে — এবং এতোধিক যে শিশুদের প্রথম জন্মদিনে, যখন তারা সাধারণত ভাষা ধারণা শুরু করে, তখন পর্যন্ত শোনা যায় এমন শব্দের চেয়ে বেশি।

হालের প্রগতি অদ্ভুত ছিল, [PERSON_NAME], স্ট্যানফোর্ড বিশ্ববিদ্যালয়ের একটি কগনিতিভ বিজ্ঞানী, LLMs সম্পর্কে বলেন। কিন্তু আমাদের এখনও একটি বন জ্বালাতে হবে এবং সমস্ত মানব জ্ঞানের মোট পরিমাণ খারচ করতে হবে যাতে এই মাইলস্টোনকে পুনরায় তৈরি করা যায় যা আমাদের বাস ঘরের মধ্যে একটি বছরে ঘটে। শিশু এবং মেশিনের মধ্যে এই বিস্তৃত পার্থক্য ডেটা দক্ষতার পার্থক্য নামে পরিচিত।

মূল entidades: কোম্পানিগুলো: Open AI, Meta | লোকেরা: [PERSON_NAME], [PERSON_NAME], [PERSON_NAME] | অবস্থান: স্ট্যানফোর্ড বিশ্ববিদ্যালয়, জর্জটাউন বিশ্ববিদ্যালয়

সामान्य প্রশ্ন: শিশুদের কীভাবে এখনও সবচেয়ে ভাষাবিদভাবে উন্নত মেশিনকে অতিক্রম করতে পারে যা কখনও তৈরি করা হয়নি?

অন্তরটি ডেটা দক্ষতায় আছে। শিশুদের প্র틴য়স বয়স পর্যন্ত প্রায় 100 মিলিয়ন শব্দ দিয়ে ভাষা শেখার অভিজ্ঞতা হয়, ενώ LLMs ট্রিলিয়ন টোকেন প্রক্রিয়া করে। ডেটা দক্ষতার পার্থক্য নির্দেশ করে যে শিশুদের জন্মজাত বুদ্ধিমত্তা গঠন বা আরও দক্ষ শেখার পদ্ধতি আছে যা AI এখনও প্রতিলিপি করতে পারেনি।

সामान्य প্রশ্ন: শিশুদের কীভাবে এখনও সবচেয়ে ভাষাবিদভাবে উন্নত মেশিনকে অতিক্রম করতে পারে যা কখনও তৈরি করা হয়নি?

সামान्य উত্তর: অন্তরটি ডেটা দক্ষতায় আছে। শিশুদের প্র틴য়স বয়স পর্যন্ত প্রায় 100 মিলিয়ন শব্দ দিয়ে ভাষা শেখার অভিজ্ঞতা হয়, enquanto LLMs ট্রিলিয়ন টোকেন প্রক্রিয়া করে। ডেটা দক্ষতার পার্থক্য নির্দেশ করে যে শিশুদের জন্মজাত বুদ্ধিমত্তা গঠন বা আরও দক্ষ শেখার পদ্ধতি আছে যা AI এখনও প্রতিলিপি করতে পারেনি।