HeadlinesBriefing favicon HeadlinesBriefing.com

Laya: Mesin Keputusan Multibahasa Terbuka 33 ms

Hacker News •
×

Penulis menjelaskan pengembangan Laya, mesin keputusan Sistem 1 multibahasa yang mencapai latensi 32,8 ms pada satu GPU, menempatkannya sebagai alternatif yang lebih cepat dan terbuka bagi model proprietari seperti Jev dari Type Safe AI. Penulis mengklaim adanya seni sebelumnya yang risal ke Maret 2025 (arXiv:2503.23303), termasuk model di Hugging Face, kumpulan data, dan paket PyPI, yang lebih awal dari peluncuran Type Safe AI pada September 2026. Didirikan oleh Diogo Almeida, penemu bersama ChatGPT di OpenAI, Type Safe AI memperkenalkan RLCD (Pembelajaran Penguatan untuk Keputusan Terkalibrasi) dengan harga $0,042 per juta token dengan latensi 150 ms.

Laya mengatasi bottleneck penggunaan LLM generatif untuk tugas klasifikasi sederhana (perutean, deteksi spam, penilaian urgensi), yang menambahkan latensi (500–2000 ms), biaya, dan risiko halusinasi. Sebaliknya, Laya menggunakan enkoder bidirectional untuk output probabilitas terkalibrasi yang instan melalui tiga primitif: choice (pilihan kategorikal), score (penempatan rubrik ordinal), dan noul (deteksi nol/absensi).

Keluarga model mendukung lebih dari 100 bahasa, beroperasi pada 7,2 ms/pertanyaan dalam mode batch, tidak memerlukan langganan API, dan melepaskan bobot di bawah lisensi Apache 2.0. Penulis menempatkan Laya sebagai puncak perbaikan batasan arsitektural dalam pekerjaan sebelumnya, beralih dari lintas penjualan vertikal ke keputusan skema yang dihorizontalkan dan digeneralisasikan.

Entitas Kunci: Perusahaan: Type Safe AI, OpenAI, Hugging Face | Orang: Diogo Almeida