HeadlinesBriefing favicon HeadlinesBriefing.com

ShapeLearn-Lite testado: Modelos Shape Learn completos superam Lite

Hacker News •
×

O Qwen 3.8 27B foi lançado em 14 de agosto de 2026, e os GGUFs do Shape Learn-Lite foram publicados quatro dias depois. Essas versões Lite usaram orçamentos de otimização menores e menos verificações. Agora, os modelos Shape Learn completos estão concluídos e foram benchmarkados ao lado do conjunto Lite.

Os modelos Shape Learn completos performam significativamente melhor. GPU-5 atinge 99,63% do score de benchmark do BF16, enquanto GPU-4 alcança 98,72% com 11,0 GB versus 13,1 GB. Todos os cinco modelos estão na fronteira de qualidade-velocidade em seis comparações de GPU.

Decodulação especulativa com MTP ou DFlash2 aumenta a throughput em todos os modelos. DFlash2 é mais rápido, mas requer mais memória e não suporta entrada de imagens. MTP funciona com imagens e é melhor para cenários limitados em VRAM.

Entidades-chave: Empresas: llama.cpp, Unsloth, ISTA-DASLab