HeadlinesBriefing favicon HeadlinesBriefing.com

روبوتات الذكاء الاصطناعي تخطئ 57% في الإجابات المالية

Financial Times Companies •
×

تُظهر أبحاث شركة التكنولوجيا Saturn أن نماذج الذكاء الاصطناعي الشهيرة من Chat GPT وClaude وCopilot وGrok وGemini تقدم إجابات خاطئة للاستفسارات المالية بنسبة متوسطة قدرها 57% من الوقت. بالنسبة للأسئلة المعقدة التي تتطلب حسابات متعددة، ترتفع نسبة الأخطاء إلى 88%، مع فشل بعض النماذج 99% من الوقت. اختبرت الدراسة أكثر من 100 سؤال متعلق بالمال عبر 18 نموذج ذكاء اصطناعي، بإجمالي أكثر من 10,000 استعلام. شملت الأخطاء أخطاء الحساب، وتجاهل التغييرات الضريبية، وقواعد مختلقة. في حالة واحدة، قدم Claude Haiku 4.5 توجيهات ضريبية تقاعدية خاطئة تعرّضت لغرامة قدرها 17,500 جنيه إسترليني من HMRC. خطأ آخر اخترع فيه Claude قاعدة تسمح بوقف سداد القروض الطلابية عند الانتقال إلى الخارج. تفوّقت النماذج المدفوعة على المجانية، وكانت الإصدارات الأحدث أكثر دقة. أفضل أداء، Claude Opus 5 في وضع التفكير، لا يزال يخطئ 39% من الوقت. قالت Sarah Coles، رئيسة التمويل الشخصي في AJ Bell، إن المستشارين يرون بشكل متزايد عملاء يتصرفون بناءً على اقتراحات الذكاء الاصطناعي المربكة. بينما يمكن للروبوتات أن تساعد في إعداد الميزانية والبحث، وجدت هيئة السلوك المالي أن واحدًا من كل خمسة بالغين بريطانيين منفتح على اتخاذ الذكاء الاصطناعي قرارات مالية، مع ثقة المستثمرين الشباب بشكل خاص. حذّر Amal Jolly من Saturn أن النصيحة المالية بالذكاء الاصطناعي لا تزال غير منظمة، مما يترك المستهلكين بدون حمايات أو تعويضات متاحة من المستشارين البشريين.