প্রিন্সটন বিশ্ববিদ্যালয়ের গবেষকদের একটি নতুন গবেষণায় বলা হয়েছে যে AI শিল্পের দ্রুত আত্ম-উন্নয়নের প্রতিশ্রুতি অতিরঞ্জিত হতে পারে। পিটার কির্গিস এবং সয়াশ কাপুরের নেতৃত্বে, টিমটি "শ্যাডো মূল্যায়ন" পদ্ধতি ব্যবহার করে AI এজেন্টদের খোলামেলা AI গবেষণা চালনা করার ক্ষমতা মূল্যায়ন করেছে। তারা অ্যানথ্রোপিকের ক্লাউড ওপস 4.8-কে অপ্রকাশিত NeurIPS 2026 পেপারগুলির প্রশ্নের উত্তর দিতে চেয়েছিল, এজেন্টদের ছয় দিন, $3,000 API ক্রেডিট এবং GPU এবং ওয়েব অ্যাক্সেস প্রদান করে।
যদিও এজেন্টরা গবেষণার ইঞ্জিনিয়ারিং দিকগুলি সফলভাবে সম্পন্ন করেছে — সাহিত্য পর্যালোচনা, পরীক্ষণ চালানো এবং ফলাফল সংকলন — তবে প্রকাশনযোগ্য কাজ উৎপাদন করতে ব্যর্থ হয়েছে। মূল লেখকরা উভয় পেপারটি প্রত্যাখ্যাত করেছেন, যেখানে সৃজনশীলতার অভাব, খারাপ বিচার এবং কোনও নতুন অবদান ছিল না। এজেন্টরা অদ্ভুত পরীক্ষণ করেছে, লেখায় কঠিনাই হয়েছে এবং খুব দ্রুতই অভিপ্রায়োগিক পদ্ধতিতে প্রতিশ্রুতি দিয়েছে।
কাপুর এই ব্যবধানকে বর্তমান প্রশিক্ষণ পদ্ধতির ফলে দায়িত্ব দিয়েছেন, উল্লেখ করে যে সশক্ত শিখন যাচায়নযোগ্য কাজে চমৎকার পারফর্ম্যান্স দেখায় কিন্তু অনুমান এবং স্বাদ প্রয়োজনীয় খোলামেলা গবেষণায় আঘাত করে। এই সীমাবদ্ধতাগুলির পাশাপাশে, গবেষণাটি প্রস্তাব করে যে AI গবেষণা স্বয়ংক্রিয়করণের জন্য প্রতিশ্রুতিমূলক সময়সূচি প্রাথমিক হতে পারে।
এই ফলাফলগুলি AI কোম্পানিগুলির অভ্যন্তরীণ প্রস্পরণাওয়ে মেলে। অ্যানথ্রোপিকের সহ-প্রতিষ্ঠাতা জ্যাক ক্লার্ক নিরাপত্তা গবেষণা স্বয়ংক্রিয়করণ প্রচেষ্টায় একই ধরনের সৃজনশীলতা ফাটল লক্ষ্য করেছেন, যা তিনি "ছোট আত্ম-উন্নয়ন সময়সূচির জন্য বিকৃত সিগন্যাল" বলে ডাকিয়েছেন
উৎস: MIT Technology Review AI · সারাংশ: HeadlinesBriefing