HeadlinesBriefing favicon HeadlinesBriefing.com

AI चैटबॉट 57% समय गलत वित्तीय उत्तर देते हैं

Financial Times Companies •
×

तकनीकी कंपनी Saturn के शोध के अनुसार, Chat GPT, Claude, Copilot, Grok और Gemini से लोकप्रिय AI मॉडल औसतन 57% समय पर वित्तीय प्रश्नों के लिए गलत उत्तर प्रदान करते हैं। कई गणनाओं की आवश्यकता वाले जटिल प्रश्नों के लिए, त्रुटि दर 88% तक बढ़ जाती है, कुछ मॉडल 99% समय पर विफल हो जाते हैं। इस अध्ययन में 18 AI मॉडल में 100 से अधिक धन संबंधी प्रश्नों का परीक्षण किया गया, जिसमें कुल 10,000 से अधिक प्रश्न शामिल थे। त्रुटियों में गणना त्रुटियां, कर में बदलावों की उपेक्षा और काल्पनिक नियम शामिल थे। एक मामले में, Claude Haiku 4.5 ने गलत पेंशन कर मार्गदर्शन दिया जिससे £17,500 का HMRC जुर्माना हो सकता था। एक अन्य त्रुटि में Claude ने विदेश जाने पर छात्र ऋण चुकौती रोकने की अनुमति देने वाला एक नियम बनाया। भुगतान मॉडल ने मुफ्त मॉडलों से बेहतर प्रदर्शन किया, और नए संस्करण अधिक सटीक थे। सर्वश्रेष्ठ प्रदर्शनकर्ता, रीज़निंग मोड में Claude Opus 5, ने भी 39% समय पर गलती की। AJ Bell के व्यक्तिगत वित्त प्रमुख Sarah Coles ने कहा कि सलाहकार लगातार ग्राहकों को भ्रमिक AI सुझावों पर कार्य करते देखते हैं। हालांकि चैटबॉट बजट बनाने और शोध में मदद कर सकते हैं, वित्तीय कार्यकारी प्राधिकरण ने पाया कि पांच में से एक ब्रिटिश वयस्क AI द्वारा वित्तीय निर्णय लेने के लिए खुला है, जहां युवा निवेशक विशेष रूप से भरोसा करते हैं। Saturn के Amal Jolly ने चेतावनी दी कि AI वित्तीय सलाह अभी भी अनियमित है, जिससे उपभोक्ताओं को मानव सलाहकारों से उपलब्ध सुरक्षा या मुआवजे की अनुपलब्धता है।