HeadlinesBriefing favicon HeadlinesBriefing.com

GLM-5.3网络能力分析

Hacker News •
×

五个月前,我们推出了Claude Mythos Preview,这是第一个能够自主构建复杂端到端网络利用的AI模型,通过Project Glasswing发布,帮助防御者发现了超过10,000个漏洞。现在,类似的模型已经出现。本文分析了来自Zhipu AI(Z.ai)的GLM-5.3,它在利用开发方面与Claude Mythos Preview相当,但缺乏有意义的防护措施,在我们的测试中,其防护措施可被绕过64%到100%的时间,这与Claude模型不同。

9月17日,NIST的CAISI评估GLM-5.3为“迄今为止发布的最具网络能力的开放权重模型”,在整体基准上落后美国前沿约四个月。与美国模型不同,后者仅限于经过审查的用户使用,GLM-5.3可自由下载,增加了恶意使用的风险,同时也为防御者提供了帮助。

我们的评估使用Exploit Bench和内部基准,显示GLM-5.3在410次尝试中成功开发了50次端到端利用,与Claude Mythos Preview的56次类似。这些能力既可用于攻击也可用于防御,突显了先进AI的双重用途性质。