Diez años después del histórico enfrentamiento de AlphaGo contra Lee Sedol, persiste una brecha crítica entre las capacidades de la IA pasada y presente. En 2016, el famoso 'Movimiento 37' de AlphaGo demostró una combinación única de intuición y cálculo. A diferencia de Deep Blue, que dependía del cálculo por fuerza bruta, AlphaGo utilizó una red de políticas para generar corazonadas y una maquinaria de búsqueda separada para ponderar las consecuencias futuras. Esta arquitectura imitó el pensamiento Sistema 1 y Sistema 2 humano, permitiendo que la IA evaluara miles de estados futuros del juego antes de seleccionar un movimiento creativo.
Los modelos de lenguaje grandes de hoy operan de manera diferente. Predicen el siguiente token de forma iterativa, confiando principalmente en la finalización rápida y asociativa de patrones. Aunque técnicas como el razonamiento en cadena de pensamiento fomentan pasos intermedios, no crean un motor de razonamiento distinto. La salida intermedia sigue siendo generada por el mismo proceso de predicción del siguiente token, lo que significa que la IA moderna carece de la maquinaria deliberativa genuina que impulsó el éxito de AlphaGo. Para lograr insights confiables y novedosos en ciencia y medicina, los sistemas futuros deben integrar un proceso de razonamiento deliberado separado, en lugar de depender únicamente de la finalización de patrones.
Fuente: MIT Technology Review AI · Resumido por HeadlinesBriefing