HeadlinesBriefing favicon HeadlinesBriefing.com

AIチャットボットの財務回答の誤り率は57%

Financial Times Companies •
×

テクノロジー企業Saturnの研究によると、Chat GPT、Claude、Copilot、Grok、Geminiの人気AIモデルは、財務に関する質問に対して平均して57%の確率で誤った回答を提供しています。複数の計算を必要とする複雑な質問では、エラー率は88%に上昇し、一部のモデルは99%の確率で失敗します。この研究では、18のAIモデルで100以上の金銭関連の質問をテストし、合計10,000以上のクエリを実施しました。エラーには計算ミス、税制変更の省略、架空のルールが含まれていました。あるケースでは、Claude Haiku 4.5が誤った年金税のガイダンスを提供し、£17,500のHMRC罰金のリスクがありました。別のエラーでは、Claudeが海外に移住した際に学生ローンの返済を停止できるという架空のルールを発明しました。有料モデルは無料モデルより優れたパフォーマンスを示し、新しいバージョンほど正確でした。最も優れたパフォーマーである推論モードのClaude Opus 5でさえ、39%の確率で誤りました。AJ Bellの個人金融責任者Sarah Colesは、アドバイザーがますます混乱を招くAIの提案に基づいて行動するクライアントを目にしていると述べました。チャットボットは予算策定やリサーチに役立ちますが、金融行為規制機構は5人のイギリス成人のうち1人がAIによる財務決定に前向きであることを発見し、若い投資家は特に信頼しています。Saturnのアマル・ジョリーは、AIの財務アドバイスは依然として規制されておらず、消費者は人間のアドバイザーから利用可能な保護や補償を受けられないと警告しました。