La provenance du contenu aide les gens à comprendre d'où vient le contenu, comment il a été créé ou modifié, et s'il contient des signaux associés à nos modèles. Aujourd'hui, nous partageons notre approche du tatouage de texte en réponse à la loi européenne sur l'IA, et comment elle s'intègre dans notre travail plus large.
À partir d'aujourd'hui, les clients API du monde entier peuvent choisir le tatouage de texte pour certains modèles. Dans les semaines à venir, nous ajouterons un tatouage invisible aux sorties de texte éligibles de ChatGPT et Codex dans l'Union européenne. Nous ouvrons les candidatures pour accéder à notre détecteur de tatouage de texte, initialement limité aux chercheurs approuvés et aux organisations expertes.
Notre technologie de tatouage de texte, text Grain, ajoute un signal statistique invisible aux choix de mots du modèle. Les taux de détection étaient considérablement plus faibles pour des contenus comme les mathématiques, où il y a moins de flexibilité dans le choix des mots. L'édition peut affaiblir le tatouage ; remplacer 10% des mots par des synonymes a réduit la détection d'environ 92% à 66%.
Source: OpenAI Blog · Résumé par HeadlinesBriefing