HeadlinesBriefing favicon HeadlinesBriefing.com

Laya: Motor de Decisión Multilingüe de Código Abierto de 33 ms

Hacker News •
×

El autor detalla el desarrollo de Laya, un motor de decisión del Sistema 1 multilingüe que alcanza 32.8 ms de latencia en una sola GPU, posicionándolo como una alternativa más rápida y de código abierto a los modelos propietarios como Jev de Type Safe AI. El autor reivindica arte anterior que data de marzo de 2025 (arXiv:2503.23303), incluyendo modelos en Hugging Face, conjuntos de datos y un paquete de PyPI, anteriores al lanzamiento de Type Safe AI en septiembre de 2026. Fundada por Diogo Almeida, co-inventor de ChatGPT en OpenAI, Type Safe AI introdujo RLCD (Aprendizaje por Refuerzo para Decisiones Calibradas) a $0.042 por millón de tokens con 150 ms de latencia.

Laya aborda el cuello de botella de usar LLMs generativos para tareas simples de clasificación (enrutamiento, detección de spam, puntuación de urgencia), lo que añade latencia (500–2000 ms), costo y riesgo de alucinación. En su lugar, Laya utiliza codificadores bidireccionales para salidas de probabilidad calibrada instantánea mediante tres primitivas: choice (selección categórica), score (colocación en rúbrica ordinal) y noul (detección de nulo/abstinencia).

La familia de modelos admite más de 100 idiomas, opera a 7.2 ms/pregunta en lote, requiere cero suscripción a API y publica pesos bajo Apache 2.0. El autor presenta a Laya como la culminación de corregir las limitaciones arquitectónicas en trabajos anteriores, pasando de trayectorias de ventas verticales a decisiones de esquema generalizado horizontal.

Entidades clave: Empresas: Type Safe AI, OpenAI, Hugging Face | Personas: Diogo Almeida