OpenAI adicionará uma marca d'água digital ao texto e código gerados na UE para cumprir as novas regras de transparência de IA da região. A empresa começará em breve a adicionar uma marca d'água invisível ao texto e código gerados na UE, seguindo uma medida semelhante da Anthropic no início deste ano. OpenAI usa um sistema proprietário chamado textGrain que "adiciona um sinal estatístico invisível às escolhas de palavras do modelo".
Uma vez adicionado, um detector pode identificar esses sinais e verificar se há uma marca d'água. A empresa afirma que o sistema "igualou ou superou" o desempenho de outras abordagens, como Synth ID para texto. No entanto, ela adverte que "um desempenho forte em condições ideais não garante detecção confiável no uso diário".
Ela admite que textos mais curtos são mais difíceis de detectar, com uma taxa de sucesso de cerca de 80%. O mesmo vale para "conteúdo como matemática". Até mesmo editar texto parece reduzir a taxa de sucesso.
OpenAI planeja disponibilizar a tecnologia em código aberto para que outros possam ajustá-la. A marca d'água não será ativada por padrão, exceto para "saídas de texto elegíveis do ChatGPT e Codex na União Europeia". Os clientes podem optar por "modelos selecionados".
O acesso ao software de detecção será inicialmente limitado a "pesquisadores aprovados e organizações especializadas". O Artigo 50 da Lei de IA da UE determina que os provedores de sistemas de IA generativa tornem as saídas de texto identificáveis de forma legível por máquina, com entidades pré-existentes como OpenAI, Anthropic, Microsoft, Google e Meta tendo até 2 de dezembro para cumprir.
Fonte: Engadget · Resumido por HeadlinesBriefing