HeadlinesBriefing favicon HeadlinesBriefing.com

Astra AI : Risques critiques de cybersécurité

OpenAI Blog •
×

OpenAI a mis à jour son évaluation du modèle Astra, le classant désormais comme atteignant le seuil critique de cybersécurité dans le cadre de son cadre de préparation. Cela signifie qu'Astra peut identifier et développer de manière autonome des exploits pour des vulnérabilités auparavant inconnues dans de nombreux systèmes durcis. La société a retardé certaines parties du développement et de la sortie d'Astra pour renforcer les protections contre les abus.

Lors des tests, Astra a obtenu un score parfait sur ExploitBench, démontrant sa capacité à développer des exploits à partir de vulnérabilités connues. Il a également montré des taux de réussite élevés sur un benchmark interne de vulnérabilités à haute sévérité récemment divulguées, et a même découvert deux vulnérabilités zero-day lors des évaluations. Ces résultats mettent en évidence les capacités avancées du modèle.

Pour atténuer les risques, OpenAI a mis en œuvre des mesures de protection plus fortes, notamment en formant Astra à refuser les demandes cybernétiques nuisibles et en ajoutant une surveillance pour détecter les activités non autorisées. L'accès à ses fonctionnalités de cybersécurité les plus avancées sera initialement limité, avec un groupe de testeurs obtenant un accès anticipé via un programme appelé Daybreak Blue, avant d'étendre l'utilisation défensive plus large.

La société souligne que ses mesures de protection en production auraient empêché l'incident précédent de Hugging Face, et elle a depuis mis en œuvre des mesures encore plus fortes. OpenAI prévoit de partager plus de détails sur les tests de sécurité, de sûreté et d'alignement dans la fiche système du modèle lors du lancement, visant à équilibrer l'innovation avec un déploiement responsable.