内容来源帮助人们了解内容来源、创建或编辑方式,以及是否包含与模型相关的信号。今天,我们分享针对欧盟AI法案的文本水印处理方法,以及它如何融入我们的更广泛工作。
从今天开始,全球API客户可以选择为特定模型启用文本水印。未来几周,我们将为欧盟地区符合条件的ChatGPT和Codex文本输出添加不可见水印。我们正在开放文本水印检测器的申请,初始阶段仅限于经批准的研究人员和专家组织。
我们的文本水印技术text Grain在模型的词汇选择中添加了不可见的统计信号。对于数学等内容,检测率显著降低,因为词汇选择灵活性较小。编辑可能会削弱水印;替换10%的单词为同义词后,检测率从约92%降至66%。
来源: OpenAI Blog · 由HeadlinesBriefing整理摘要