HeadlinesBriefing favicon HeadlinesBriefing.com

GLM-5.3サイバー能力分析

Hacker News •
×

5か月前、私たちはClaude Mythos Previewを発表しました。これは、洗練されたエンドツーエンドのサイバーエクスプロイトを自律的に構築できる最初のAIモデルであり、Project Glasswingを通じてリリースされ、防御側が10,000以上の脆弱性を見つけるのを支援しました。現在、同様のモデルが登場しています。この投稿では、Zhipu AI(Z.ai)のGLM-5.3を分析します。これは、エクスプロイト開発においてClaude Mythos Previewに匹敵しますが、意味のある保護手段がなく、私たちのテストでは64%から100%の確率でバイパスが可能であり、Claudeモデルとは異なります。

9月17日、NISTのCAISIはGLM-5.3を「これまでにリリースされた中で最もサイバー能力の高いオープンウェイトモデル」と評価し、米国のフロンティアより約4か月遅れています。検証済みユーザーに限定されている米国モデルとは異なり、GLM-5.3は自由にダウンロードでき、悪意のある使用のリスクを高めると同時に防御側にも役立ちます。

Exploit Benchと内部ベンチマークを使用した私たちの評価では、GLM-5.3は410回の試行のうち50回でエンドツーエンドのエクスプロイトを開発し、Claude Mythos Previewの56回に類似しています。これらの能力は攻撃と防御の両方に利用でき、高度なAIの二重使用の性質を浮き彫りにしています。