HeadlinesBriefing favicon HeadlinesBriefing.com

Qwen3.8-Flash-Next: Alibaba mostra Qwen4

Hacker News •
×

A Alibaba lançou o Qwen3.8-Flash-Next, um modelo multimodal de mistura de especialistas de pesos abertos construído sobre a arquitetura Qwen4, antes de existir qualquer modelo Qwen4. O repositório oficial do Hugging Face foi ao ar em 24 de agosto, dois dias antes do lançamento programado do Model Scope em 26 de agosto. A ficha do modelo confirma que é "uma prévia experimental da arquitetura que sustentará o Qwen4".

As principais mudanças arquitetônicas incluem a Rede Delta com Portão (GDN) e a Atenção Dispersa Qwen (QSA), dentro de uma camada híbrida de 48 camadas, com 36 camadas de atenção linear e 12 de atenção completa. O modelo tem 125B parâmetros totais com 6B ativados por token, 512 especialistas, uma tabela de incorporação n-grama separada de 51B, e contexto nativo de 262.144 tokens, extensível a 1.000.000. Os pesos não são portados e estão totalmente especificados.

A Alibaba apresenta isso como um compromisso técnico: pré-visualizar primeiro a parte difícil, para que os runtimes e aplicativos estejam prontos para a família Qwen4. No entanto, as pontuações de benchmark permanecem não confirmadas e não reproduzidas de forma independente. O lançamento formal do Model Scope ainda está programado para 2026-08-26 23:00 (UTC+08:00), mas os pesos já venceram o cronômetro.

Entidades-chave: Empresas: Alibaba | Pessoas: @kimmonismus | Locais: Hugging Face, Model Scope