HeadlinesBriefing favicon HeadlinesBriefing.com

Astra AI关键网络安全风险与防护

OpenAI Blog •
×

OpenAI已更新其对Astra模型的评估,现将其归类为在其准备框架下达到关键网络安全阈值。这意味着Astra能够自主识别并开发针对许多加固系统中未知漏洞的漏洞利用。该公司已推迟Astra的部分开发和发布,以加强对滥用的防护。

在测试中,Astra在ExploitBench上取得了完美分数,展示了其从已知漏洞开发漏洞利用的能力。它还在最近披露的高严重性漏洞的内部基准测试中表现出高成功率,甚至在评估期间发现了两个零日漏洞。这些发现凸显了该模型的高级能力。

为降低风险,OpenAI实施了更强的防护措施,包括训练Astra拒绝有害的网络请求,并添加监控以检测未经授权的活动。其最先进的网络安全功能将初步限制访问,一组测试人员将通过名为Daybreak Blue的程序获得早期访问权限,然后再扩大防御性使用。

该公司强调,其生产防护措施本可以防止早前的Hugging Face事件,并且此后已实施更强的措施。OpenAI计划在发布时在模型的系统卡中分享更多关于安全、安保和一致性测试的细节,旨在平衡创新与负责任部署。