コンテンツの出所は、コンテンツがどこから来たのか、どのように作成または編集されたのか、そしてモデルに関連するシグナルが含まれているかを理解するのに役立ちます。本日、EU AI法に対応したテキスト透かしへのアプローチと、それが私たちのより広範な取り組みにどのように適合するかを共有します。
本日より、世界中のAPI顧客は、選択したモデルに対してテキスト透かしをオプトインできます。今後数週間で、欧州連合内の対象となるChatGPTおよびCodexテキスト出力に不可視の透かしを追加します。テキスト透かし検出器へのアクセス申請を受け付けています。当初は承認された研究者と専門家組織に限定されます。
当社のテキスト透かし技術text Grainは、モデルの単語選択に不可視の統計的シグナルを追加します。数学などのコンテンツでは、単語選択の柔軟性が低いため、検出率が大幅に低下しました。編集により透かしが弱まる可能性があります。10%の単語を同義語に置き換えると、検出率が約92%から66%に低下しました。
出典: OpenAI Blog · 要約:HeadlinesBriefing