Die Herkunft von Inhalten hilft Menschen zu verstehen, woher Inhalte kamen, wie sie erstellt oder bearbeitet wurden und ob sie mit unseren Modellen verbundene Signale enthalten. Heute teilen wir unseren Ansatz für Text-Wasserzeichen als Reaktion auf das EU-KI-Gesetz und wie er in unsere breitere Arbeit passt.
Ab heute können API-Kunden weltweit Text-Wasserzeichen für ausgewählte Modelle aktivieren. In den kommenden Wochen werden wir eine unsichtbare Wasserzeichen zu berechtigten ChatGPT- und Codex-Textausgaben in der Europäischen Union hinzufügen. Wir öffnen Bewerbungen für den Zugang zu unserem Text-Wasserzeichen-Detektor, der zunächst auf genehmigte Forscher und Expertenorganisationen beschränkt ist.
Unsere Text-Wasserzeichen-Technologie, text Grain, fügt den Wortwahl des Modells ein unsichtbares statistisches Signal hinzu. Die Erkennungsraten waren für Inhalte wie Mathematik wesentlich niedriger, wo die Wortwahl weniger flexibel ist. Bearbeitung kann die Wasserzeichen schwächen; das Ersetzen von 10% der Wörter durch Synonyme reduzierte die Erkennung von etwa 92% auf 66%.
Quelle: OpenAI Blog · Zusammengefasst von HeadlinesBriefing