HeadlinesBriefing favicon HeadlinesBriefing.com

Qwen3-Omni-Flash-2025-12-01:下一代多模态模型

Hacker News •
×

Qwen3-Omni-Flash-2025-12-01是一款拥有300亿参数和30亿活跃参数的下一代原生多模态大模型,继承了之前的7B全模态模型。它被定位为Qwen3-Omni-30B-A3B-Instruct的继任者,尽管其权重目前不在开源框架中,这使得其使用受限,尽管其性能表现强劲。该模型包含650M音频编码器、540M视觉编码器、30B-A3B LLM、3B-A0.3B音频LLM以及80M Transformer/200M卷积网络,用于音频token到波形的转换。存在一个推理版本,可能在语音交互过程中发出思考token,增加了一个有趣的交互元素。虽然一些人推测它可能是一个闭权重模型即服务,因为其'Flash'设计,但其他人指出,鉴于其基准测试性能与更大模型的对比,它可能是Qwen3-235B-A22B的全模态版本。该模型的上下文窗口可能扩展至200K+ tokens,但截至文章撰写时,其权重仍未在Hugging Face或ModelScope上发布。确认了实时对话支持,但本地硬件实现尚未由社区验证。