Jev — новая модель классификатора «System One» от Type Safe. Название вдохновлено книгой Дэниела Канемана «Думай медленно... решай быстро», в которой он различает быстрое, интуитивное мышление Системы Один и более медленное, осознанное мышление Системы Два. Большие языковые модели (LLM), такие как Claude или GPT, являются моделями Системы Два, а «модели решений», такие как Jev и его предшественники (например, Laya), — Системы Один.
Jev берет предварительно обученный трансформер и добавляет классификатор в конец, что позволяет ему немедленно использовать новый контекст, оставаясь классификатором. Вы даете ему контекст и вопрос с множественным выбором, а он возвращает распределение вероятностей по вариантам. Вся серия экспериментов стоила менее $4.00.
Я проверил калибровку Jev, используя хорошо известные физические распределения, такие как распределение Максвелла-Больцмана. Я выбрал 10 кандидатных распределений, 5 шаблонов промптов для каждого распределения и 20 вариаций для каждого промпта, что дает 1,000 настроек. GPT-6 Astra и Claude Opus 5.5 использовались для реализации экспериментов, написания шаблонных промптов и вызовов API.
Источник: Hacker News · Сводку подготовил HeadlinesBriefing