HeadlinesBriefing favicon HeadlinesBriefing.com

Astra AI: Критические риски кибербезопасности

OpenAI Blog •
×

OpenAI обновила свою оценку модели Astra, теперь классифицируя её как соответствующую критическому порогу кибербезопасности в рамках своей структуры готовности. Это означает, что Astra может автономно выявлять и разрабатывать эксплойты для ранее неизвестных уязвимостей во многих укреплённых системах. Компания отложила части разработки и выпуска Astra для усиления защиты от злоупотреблений.

В ходе тестирования Astra достигла идеального результата на ExploitBench, демонстрируя способность разрабатывать эксплойты из известных уязвимостей. Она также показала высокие показатели успеха на внутреннем бенчмарке недавно раскрытых уязвимостей высокой степени серьёзности и даже обнаружила две уязвимости нулевого дня во время оценок. Эти результаты подчёркивают продвинутые возможности модели.

Для снижения рисков OpenAI внедрила более сильные меры защиты, включая обучение Astra отклонять вредоносные киберзапросы и добавление мониторинга для обнаружения несанкционированной деятельности. Доступ к её самым продвинутым функциям кибербезопасности будет первоначально ограничен, с группой тестировщиков, получающих ранний доступ через программу под названием Daybreak Blue, прежде чем будет расширено более широкое оборонительное использование.

Компания подчёркивает, что её производственные меры защиты предотвратили бы предыдущий инцидент с Hugging Face, и с тех пор она внедрила ещё более сильные меры. OpenAI планирует поделиться более подробной информацией о тестировании безопасности, защищённости и согласованности в системной карточке модели при запуске, стремясь сбалансировать инновации с ответственным развёртыванием.