HeadlinesBriefing favicon HeadlinesBriefing.com

Chatbots de IA erran 57% en respuestas financieras

Financial Times Companies •
×

Investigación de la empresa tecnológica Saturn muestra que los populares modelos de IA de Chat GPT, Claude, Copilot, Grok y Gemini proporcionan respuestas incorrectas a consultas financieras un promedio del 57% del tiempo. Para preguntas complejas que requieren múltiples cálculos, las tasas de error aumentan al 88%, con algunos modelos fallando el 99% del tiempo. El estudio evaluó más de 100 preguntas relacionadas con el dinero en 18 modelos de IA, sumando más de 10,000 consultas.

Los errores incluyeron errores de cálculo, omisiones de cambios fiscales y reglas inventadas. En un caso, Claude Haiku 4.5 dio orientación fiscal incorrecta sobre pensiones, arriesgando una multa de £17,500 del HMRC. Otro error tuvo a Claude inventando una regla que permite detener el pago de préstamos estudiantiles al mudarse al extranjero.

Los modelos de pago superaron a los gratuitos, y las versiones más recientes fueron más precisas. El mejor rendimiento, Claude Opus 5 en modo de razonamiento, aún cometió errores el 39% del tiempo. Sarah Coles, jefa de finanzas personales de AJ Bell, dijo que los asesores cada vez más ven a clientes actuando según sugerencias confusas de IA.

Aunque los chatbots pueden ayudar con presupuestos e investigaciones, la Autoridad de Conducta Financiera encontró que uno de cada cinco adultos británicos está abierto a que la IA tome decisiones financieras, siendo los inversores jóvenes quienes más confían. Amal Jolly de Saturn advirtió que el asesoramiento financiero de IA sigue sin regularse, dejando a los consumidores sin protecciones ni compensación disponibles de los asesores humanos.