Jev es el nuevo modelo clasificador "System One" de Type Safe. El nombre está inspirado en el libro de Daniel Kahneman, Pensar rápido, pensar despacio, donde distingue entre el pensamiento rápido e instintivo del Sistema Uno y el pensamiento más lento y consciente del Sistema Dos. Los modelos de lenguaje grandes (LLM) como Claude o GPT son modelos del Sistema Dos, mientras que los "modelos de decisión" como Jev y sus predecesores (por ejemplo, Laya) son del Sistema Uno.
Jev toma un transformer preentrenado y le añade un clasificador al final, permitiendo usar nuevo contexto inmediatamente mientras actúa como clasificador. Le das contexto y una pregunta de opción múltiple, y devuelve una distribución de probabilidad sobre las opciones. Toda la serie de experimentos costó menos de $4.00.
Probé la calibración de Jev usando distribuciones físicas bien conocidas, como la distribución de Maxwell-Boltzmann. Elegí 10 distribuciones candidatas, 5 plantillas de prompt por distribución y 20 variaciones por prompt, dando un total de 1,000 configuraciones. GPT-6 Astra y Claude Opus 5.5 se usaron para implementar los experimentos, escribir las plantillas y las llamadas API.
Fuente: Hacker News · Resumido por HeadlinesBriefing