Provenans konten membantu orang memahami dari mana konten berasal, bagaimana konten dibuat atau diedit, dan apakah konten mengandung sinyal yang terkait dengan model kami. Hari ini, kami membagikan pendekatan kami terhadap watermark teks sebagai respons terhadap Undang-Undang AI UE, dan bagaimana hal itu sesuai dengan pekerjaan kami yang lebih luas.
Mulai hari ini, pelanggan API secara global dapat memilih untuk menggunakan watermark teks untuk model tertentu. Dalam beberapa minggu mendatang, kami akan menambahkan watermark tak terlihat ke output teks ChatGPT dan Codex yang memenuhi syarat di Uni Eropa. Kami membuka aplikasi untuk mengakses detektor watermark teks kami, yang awalnya terbatas pada peneliti yang disetujui dan organisasi ahli.
Teknologi watermark teks kami, text Grain, menambahkan sinyal statistik tak terlihat pada pilihan kata model. Tingkat deteksi secara substansial lebih rendah untuk konten seperti matematika, di mana ada lebih sedikit fleksibilitas dalam pilihan kata. Pengeditan dapat melemahkan watermark; mengganti 10% kata dengan sinonim mengurangi deteksi dari sekitar 92% menjadi 66%.
Sumber: OpenAI Blog · Diringkas oleh HeadlinesBriefing