HeadlinesBriefing favicon HeadlinesBriefing.com

ShapeLearn-Lite протестирован: полные модели Shape Learn превосходят Lite

Hacker News •
×

Qwen 3.8 27B был выпущен 14 августа 2026 года, а GGUF-файлы Shape Learn-Lite были опубликованы через четыре дня. Эти Lite-версии использовали более маленькие бюджеты оптимизации и меньше проверок. Теперь полные модели Shape Learn завершены и протестированы вместе с набором Lite.

Полные модели Shape Learn работают значительно лучше. GPU-5 достигает 99,63% балла BF16 в бенчмарке, в то время как GPU-4 показывает 98,72% при 11,0 ГБ против 13,1 ГБ. Все пять моделей находятся на границе качества-скорости в шести сравнениях GPU.

Спекулятивное декодирование с MTP или DFlash2 повышает производительность во всех моделях. DFlash2 быстрее, но требует больше памяти и не поддерживает ввод изображений. MTP работает с изображениями и лучше подходит для сценариев с ограничением VRAM.

Ключевые сущности: Компании: llama.cpp, Unsloth, ISTA-DASLab