HeadlinesBriefing favicon HeadlinesBriefing.com

Astra AI: Kritische Cybersicherheitsrisiken

OpenAI Blog •
×

OpenAI hat seine Bewertung des Astra-Modells aktualisiert und stuft es nun als Erfüllung der kritischen Cybersicherheitsschwelle im Rahmen seines Preparedness Framework ein. Das bedeutet, dass Astra autonom Schwachstellen in vielen gehärteten Systemen identifizieren und Exploits für bisher unbekannte Schwachstellen entwickeln kann. Das Unternehmen hat Teile der Entwicklung und Veröffentlichung von Astra verzögert, um den Schutz vor Missbrauch zu stärken.

In Tests erzielte Astra eine perfekte Punktzahl auf ExploitBench und demonstrierte damit seine Fähigkeit, Exploits aus bekannten Schwachstellen zu entwickeln. Es zeigte auch hohe Erfolgsraten bei einem internen Benchmark kürzlich offengelegter Schwachstellen mit hoher Schwere und entdeckte während der Bewertungen sogar zwei Zero-Day-Schwachstellen. Diese Ergebnisse unterstreichen die fortschrittlichen Fähigkeiten des Modells.

Um Risiken zu mindern, hat OpenAI stärkere Schutzmaßnahmen implementiert, darunter das Training von Astra, schädliche Cyberanfragen abzulehnen, und die Hinzufügung von Überwachung zur Erkennung unbefugter Aktivitäten. Der Zugriff auf seine fortschrittlichsten Cybersicherheitsfunktionen wird zunächst eingeschränkt, wobei eine Gruppe von Testern über ein Programm namens Daybreak Blue frühen Zugriff erhält, bevor die breitere defensive Nutzung ausgeweitet wird.

Das Unternehmen betont, dass seine Produktionsschutzmaßnahmen den früheren Hugging Face-Vorfall verhindert hätten, und es hat seitdem noch stärkere Maßnahmen implementiert. OpenAI plant, bei der Einführung weitere Details zu Sicherheits-, Schutz- und Ausrichtungstests in der Systemkarte des Modells zu teilen, mit dem Ziel, Innovation und verantwortungsvolle Bereitstellung in Einklang zu bringen.