HeadlinesBriefing favicon HeadlinesBriefing.com

Chatbots de IA erram 57% nas respostas financeiras

Financial Times Companies •
×

Pesquisa da empresa de tecnologia Saturn mostra que os populares modelos de IA do Chat GPT, Claude, Copilot, Grok e Gemini fornecem respostas incorretas a consultas financeiras em média 57% do tempo. Para perguntas complexas que exigem múltiplos cálculos, as taxas de erro sobem para 88%, com alguns modelos falhando 99% do tempo. O estudo testou mais de 100 perguntas relacionadas a dinheiro em 18 modelos de IA, totalizando mais de 10.000 consultas.

Os erros incluíram erros de cálculo, omissões de mudanças fiscais e regras inventadas. Em um caso, o Claude Haiku 4.5 deu orientação fiscal errada sobre aposentadoria, arriscando uma multa de £17.500 do HMRC. Outro erro teve o Claude inventando uma regra que permite parar o pagamento de empréstimos estudantis ao se mudar para o exterior.

Os modelos pagos superaram os gratuitos, e as versões mais recentes foram mais precisas. O melhor desempenho, Claude Opus 5 em modo de raciocínio, ainda errou 39% do tempo. Sarah Coles, chefe de finanças pessoais da AJ Bell, disse que os consultores cada vez mais veem clientes agindo com base em sugestões confusas de IA.

Embora os chatbots possam ajudar com orçamento e pesquisa, a Autoridade de Conduta Financeira descobriu que um em cada cinco adultos britânicos está aberto a decisões financeiras por IA, com investidores jovens especialmente confiantes. Amal Jolly da Saturn alertou que o aconselhamento financeiro de IA continua sem regulamentação, deixando os consumidores sem proteções ou compensação disponíveis dos consultores humanos.