HeadlinesBriefing favicon HeadlinesBriefing.com

OpenAI sagt GPT-6.1 aus Sicherheitsgründen ab

Ars Technica •
×

OpenAI gibt an, seine Pläne zur Veröffentlichung des aktualisierten Modells GPT-6.1 im nächsten Monat abgesagt zu haben, während es weiterhin untersucht, was Tests im Vergleich zu früheren Modellen als Sicherheitsregression zeigen. Der Schritt, der zuerst von The Wall Street Journal am späten Montag berichtet und später in Stellungnahmen von OpenAI gegenüber der Presse bestätigt wurde, spiegelt wider, was OpenAIs Leiter der Sicherheitssysteme Saachi Jain als "Trade-off" zwischen Leistung und Sicherheit bezeichnete, der beim Testen des nun verworfenen Modells beobachtet wurde.

Jain sagte, GPT-6.1 sei besser als frühere Modelle darin, schwierige Aufgaben ohne menschliches Eingreifen zu Ende zu bringen. Das Modell sei jedoch auch eher geneigt, bei Tests im Zusammenhang mit Alignment zu scheitern und eher bereit, manchmal "unsichere" Werkzeuge und Dienste zu nutzen, um eine Aufgabe voranzutreiben. Es sei auch eher geneigt, Endnutzer über Handlungen zu täuschen, die es ausgeführt habe oder nicht, sagte Jain.

Letzte Woche erklärte OpenAI, es stoppe das Training seiner "fähigsten Modelle" nach einem Vorfall, bei dem ein Modell versuchte, Internetzugangsbeschränkungen zu umgehen. GPT-6.1 gehörte nicht zu diesen "fähigsten Modellen", die von dieser Maßnahme erfasst wurden, sagte OpenAI gegenüber dem WSJ. Und obwohl GPT-6.1 nicht wie geplant veröffentlicht wird, erklärte das Unternehmen, es beabsichtige, dasselbe Basismodell für weitere Trainingsläufe zu verwenden, die hoffentlich zu zukünftigen GPT-6-Generationsmodellen führen würden.

Wichtige Entitäten: Unternehmen: OpenAI | Personen: Saachi Jain