আমি Lathoa-কে 10 থেকে 14 বছর বয়সের শিশুদের জন্য তৈরি করেছি। একটি নাম Errol রোবট ধাপে ধাপে গণিত সমস্যার সমাধান করে, কিন্তু একটি ধাপ ইচ্ছাকৃতভাবে ভুল হয়। শিশুটি ভুলটি খুঁজে বের করতে এবং সেটি কেন ভুল ব্যাখ্যা করতে হয় যাতে তারা XP পায়। কখনও কখনও কিছু ভুল হয় না, তাই অনুমান করা 'একটি ভুল আছে' কাজ করে না—ব্যাখ্যা প্রয়োজন। গতি একটি স্কোরে প্রভাব ফেলে। কোনও সরাসরি LLM চ্যাট নেই; Lathoa স্থিতিশীলতা ব্যবহার করে মূল্যায়ন ধাপগুলি ক্যাপচার করতে অসঙ্গতি এবং প্রম্পট ইনজেকশনগুলি। আপনি হোমপেজে সাইন-আপ করা ছাড়া একটি কেস খেলতে পারেন। LLM-কে ইচ্ছাকৃতভাবে ভুল করা কতটা কঠিন: আপেলারা আধার মধ্যে এটি সঠিক উত্তর দেয় এবং সেটি ভুল বলে ডাকে, বা সঠিক ধাপকে ভুল হিসাবে চিহ্নিত করে। তাই, প্রতিটি কেস প্রথমে যাচাই করা হয়। সম্ভব হলে, একটি সাধারণ অংকগণিত চেক সঠিকভাবে গণিত পুনরায় করে। দ্বিতীয় মডেল Errol-এর কাজ দেখা ছাড়া সমস্যার সমাধান করে। যদি তারা মত মিলে না, কেস ফেলে যায়। দুর্বলতা হল যে দ্বিতীয় মডেলটি প্রথমের সাথে একই ভুল করতে পারে। অংকগণিত চেক মানে কিছু হয়, কিন্তু এটি পর্যন্ত শুধুমম ইংরেজি কেসে কাজ করে—জার্মান ও গ্রিকের দশমিক সংখ্যা জন্য কমা ব্যবহার করে, এবং পার্সিং এখনও ঠিক করা হয়নি। আমি শিগগিরি করি: কাকে ধরা ভুল খুঁজে বের করা নিজে নিজে সমস্যা সমাধান করার চেয়ে বেশি শিখে? আমি নিশ্চিত নই, এবং আমি শিক্ষকদের থেকে মতামত চাই।
উৎস: Hacker News · সারাংশ: HeadlinesBriefing