HeadlinesBriefing favicon HeadlinesBriefing.com

GLM-5.3-Flash:前沿AI,闪电成本

Hacker News •
×

2026-08-26 · 研究 GLM-5.3-Flash:前沿智能,闪电成本* 在Z.ai上调用* Z.ai编码计划* 使用ZCode编码* Hugging Face 我们推出GLM-5.3-Flash,这是GLM-5系列中首个原生多模态模型。拥有320B总参数和仅18B激活参数,它在基准测试和实际工作负载上以十分之一的价格超越GLM-5.2,同时在编码和智能体基准上接近Claude Opus 4.8。

GLM-5.3-Flash在GLM-5的基础上引入了多项架构改进。我们首次引入结合稀疏注意力和线性注意力的混合架构,大幅降低长上下文服务成本,同时保持精确的长上下文能力。它还采用流形约束超连接(m HC)以进一步提高扩展效率。结合我们最新的30T token多模态预训练语料库,这些变化使GLM-5.3-Flash能够以更少的计算产生更多智能。

在发布前,我们在Open Code和Open Router上以`ox-alpha`匿名测试GLM-5.3-Flash以收集用户反馈。它迅速成为当周最受欢迎的模型——所有这些流量都在中国AI芯片上提供服务。GLM-5.3-Flash推动了Artificial Analysis Intelligence Index v4.1.1的帕累托前沿,得分57,每任务仅需$0.045(折扣价)——这种智能水平以前只能以大约10倍的成本获得。

在六个编码和智能体基准上,GLM-5.3-Flash始终优于GLM-5.2,通常差距很大——在Deep SWE v1.1上为63.4对46.2,在Automation Bench上为48.8对26.2——同时整体接近Claude Opus 4.8。与GLM-4.5系列相比,GLM-5.3-Flash专为超低成本推理设计,激活参数数量和层数几乎减半。

关键实体:公司:Z.ai、Hugging Face、Open Code、Open Router