HeadlinesBriefing favicon HeadlinesBriefing.com

ShapeLearn-Lite diuji: Model Shape Learn penuh unggul Lite

Hacker News •
×

Qwen 3.8 27B dirilis pada 14 Agustus 2026, dan GGUF Shape Learn-Lite diterbitkan empat hari kemudian. Versi Lite ini menggunakan anggaran optimasi yang lebih kecil dan fewer checks. Sekarang, model Shape Learn penuh selesai dan diuji bersama dengan set Lite.

Model Shape Learn penuh berkinerja jauh lebih baik. GPU-5 mencapai 99,63% skor benchmark BF16, sementara GPU-4 mencapai 98,72% dengan 11,0 GB versus 13,1 GB. Kelima model berada pada frontier kualitas-kecepatan dalam enam perbandingan GPU.

Decoding spekulatif dengan MTP atau DFlash2 meningkatkan throughput across semua model. DFlash2 lebih cepat tapi membutuhkan lebih banyak memori dan tidak mendukung input gambar. MTP bekerja dengan input gambar dan lebih baik untuk skenario terbatas VRAM.

Entitas kunci: Perusahaan: llama.cpp, Unsloth, ISTA-DASLab