HeadlinesBriefing favicon HeadlinesBriefing.com

AI চ্যাটবট ৫৭% সময় ভুল আর্থিক উত্তর দেয়

Financial Times Companies •
×

প্রযুক্তি কোম্পানি Saturn-এর গবেষণা দেখিয়েছে যে Chat GPT, Claude, Copilot, Grok এবং Gemini থেকে জনপ্রিয় AI মডেলগুলো গড়ে ৫৭% সময় আর্থিক প্রশ্নের জন্য ভুল উত্তর প্রদান করে। একাধিক হিসাব প্রয়োজন এমন জটিল প্রশ্নের জন্য, ত্রুটির হার ৮৮% পর্যন্ত বাড়ে, কিছু মডেল ৯৯% সময় ব্যর্থ হয়। এই গবেষণায় ১৮টি AI মডেলে ১০০-এর বেশি অর্থ-সম্পর্কিত প্রশ্ন পরীক্ষা করা হয়েছে, যার মোট ১০,০০০-এর বেশি প্রশ্ন ছিল। ত্রুটিগুলোর মধ্যে ছিল হিসাবের ভুল, কর পরিবর্তন এড়িয়ে যাওয়া এবং কল্পনা করা নিয়ম। একটি ক্ষেত্রে, Claude Haiku 4.5 ভুল পেনশন কর পরামর্শ দিয়ে £17,500 HMRC জরিমানার ঝুঁকি তৈরি করেছিল। আরেকটি ভুলে Claude ছাত্র ঋণ পরিশোধ বন্ধ করার অনুমতি দেওয়া এমন একটি নিয়ম বানিয়ে ফেলেছিল যখন বিদেশে চলে যাওয়া হয়। পেমেন্ট মডেলগুলো ফ্রি মডেলের চেয়ে ভালো করেছে, এবং নতুন সংস্করণ আরও সঠিক ছিল। সেরা পারফর্মার, রিজনিং মোডে Claude Opus 5, তবুও ৩৯% সময় ভুল করেছিল। AJ Bell-এর ব্যক্তিগত আর্থিক প্রধান Sarah Coles বলেছেন যে পরামর্শদাতারা ক্রমাগত বিভ্রান্তিকর AI পরামর্শের উপর কাজ করা ক্লায়েন্টদের দেখছেন। যদিও চ্যাটবট বাজেট এবং গবেষণায় সাহায্য করতে পারে, ফিন্যান্সিয়াল কন্ডাক্ট অথরিটি দেখেছে যে পাঁচজনের একজন ব্রিটিশ প্রাপ্তবয়স্ক AI দ্বারা আর্থিক সিদ্ধান্ত নেওয়ার জন্য উন্মুক্ত, যেখানে তরুণ বিনিয়োগকারীরা বিশেষভাবে আস্থাশীল। Saturn-এর Amal Jolly সতর্ক করেছেন যে AI আর্থিক পরামর্শ এখনো নিয়ন্ত্রিত নয়, যা ভোক্তাদের মানুষের পরামর্শদাতাদের কাছ থেকে পাওয়া সুরক্ষা বা ক্ষতিপূরণ ছাড়াই রেখে দেয়।