HeadlinesBriefing favicon HeadlinesBriefing.com

ИИ-чатботы ошибаются в 57% финансовых ответов

Financial Times Companies •
×

Исследование технологической компании Saturn показывает, что популярные модели ИИ от Chat GPT, Claude, Copilot, Grok и Gemini предоставляют неправильные ответы на финансовые запросы в среднем в 57% случаев. Для сложных вопросов, требующих нескольких вычислений, уровень ошибок возрастает до 88%, при этом некоторые модели ошибаются в 99% случаев. Исследование протестировало более 100 вопросов, связанных с деньгами, на 18 моделях ИИ, проведя более 10 000 запросов. Ошибки включали вычислительные ошибки, пропуск налоговых изменений и выдуманные правила. В одном случае Claude Haiku 4.5 дал неправильные налоговые рекомендации по пенсии, рискуя штрафом в £17 500 от HMRC. В другой ошибке Claude придумал правило, позволяющее прекратить погашение студенческих займов при переезде за границу. Платные модели показали лучшие результаты, чем бесплатные, а более новые версии были точнее. Лучший результат — Claude Opus 5 в режиме рассуждений — всё равно ошибался в 39% случаев. Сара Коулз, руководитель личных финансов в AJ Bell, сказала, что консультанты всё чаще видят клиентов, действующих по сбивчивым рекомендациям ИИ. Хотя чатботы могут помогать с бюджетированием и исследованиями, Управление по финансовому регулированию обнаружило, что каждый пятый взрослый в Великобритании готов к тому, чтобы ИИ принимал финансовые решения, при этом молодые инвесторы особенно доверяют. Амаль Джолли из Saturn предупредила, что финансовые рекомендации ИИ по-прежнему не регулируются, оставляя потребителей без защиты или компенсации, доступной у человеческих консультантов.