A proveniência do conteúdo ajuda as pessoas a entender de onde o conteúdo veio, como foi criado ou editado e se contém sinais associados aos nossos modelos. Hoje, compartilhamos nossa abordagem para marca d'água de texto em resposta à Lei de IA da UE, e como ela se encaixa em nosso trabalho mais amplo.
A partir de hoje, clientes API globalmente podem optar pela marca d'água de texto para modelos selecionados. Nas próximas semanas, adicionaremos uma marca d'água invisível à saída de texto elegível do ChatGPT e Codex na União Europeia. Estamos abrindo inscrições para acessar nosso detector de marca d'água de texto, inicialmente limitado a pesquisadores aprovados e organizações especializadas.
Nossa tecnologia de marca d'água de texto, text Grain, adiciona um sinal estatístico invisível às escolhas de palavras do modelo. As taxas de detecção foram substancialmente menores para conteúdo como matemática, onde há menos flexibilidade na escolha de palavras. A edição pode enfraquecer a marca d'água; substituir 10% das palavras por sinônimos reduziu a detecção de cerca de 92% para 66%.
Fonte: OpenAI Blog · Resumido por HeadlinesBriefing