HeadlinesBriefing favicon HeadlinesBriefing.com

Astra AI:重大なサイバーセキュリティリスク

OpenAI Blog •
×

OpenAIはAstraモデルの評価を更新し、現在はその準備フレームワークの下で重大なサイバーセキュリティ閾値を満たすものとして分類しています。これは、Astraが多くの堅牢なシステムにおける未知の脆弱性に対して自律的に特定し、エクスプロイトを開発できることを意味します。同社は悪用に対する保護を強化するため、Astraの開発とリリースの一部を延期しました。

テストでは、AstraはExploitBenchで完璧なスコアを達成し、既知の脆弱性からエクスプロイトを開発する能力を示しました。また、最近公開された高重大度の脆弱性の内部ベンチマークで高い成功率を示し、評価中に2つのゼロデイ脆弱性を発見しました。これらの発見は、モデルの高度な能力を浮き彫りにしています。

リスクを軽減するため、OpenAIはより強力な保護策を実施しました。これには、Astraに有害なサイバーリクエストを拒否するよう訓練し、不正な活動を検出するための監視を追加することが含まれます。その最も高度なサイバーセキュリティ機能へのアクセスは当初制限され、テスターのグループがDaybreak Blueと呼ばれるプログラムを通じて早期アクセスを得て、その後より広範な防御的使用が拡大されます。

同社は、その本番保護策が以前のHugging Faceインシデントを防いだであろうことを強調し、それ以来さらに強力な措置を実施しています。OpenAIは、起動時にモデルのシステムカードで安全性、セキュリティ、整合性テストの詳細を共有する計画であり、革新と責任ある展開のバランスを目指しています。