OpenAI anuncia o textGrain, marca-d’água invisível para textos gerados pelo ChatGPT

Foto: Reprodução

A OpenAI anunciou oficialmente o lançamento do textGrain, uma tecnologia de marca-d’água invisível projetada para identificar textos produzidos por suas ferramentas de inteligência artificial. A implementação inicial ocorrerá nas próximas semanas, direcionada aos usuários do ChatGPT e do Codex na União Europeia. O movimento está alinhado às diretrizes de transparência estabelecidas pelo AI Act europeu, que demanda que materiais gerados por sistemas artificiais sejam passíveis de identificação por máquinas.

Diferente de abordagens tradicionais, o recurso não adiciona etiquetas visíveis, caracteres ocultos ou espaços extras ao corpo do texto. O funcionamento do textGrain ocorre diretamente durante o processo de geração de conteúdo. Os modelos de linguagem computam diferentes probabilidades para os próximos tokens e a ferramenta ajusta sutilmente essas métricas, criando um padrão estatístico discernível ao longo da leitura.

Posteriormente, esse padrão pode ser verificado por meio de um detector proprietário da OpenAI. Conforme relatado pela empresa, a solução consegue apontar se um sistema da desenvolvedora participou da criação ou edição do material. A estratégia segue passos semelhantes aos adotados pela Anthropic, criadora do Claude, que introduziu sua própria marca-d’água baseada no SynthID-Text em agosto. Em testes comparativos, a OpenAI destacou que o textGrain igualou ou superou outras técnicas avaliadas e informou planos de disponibilizar o código como open source.

Limitantes técnicos e restrições de acesso
Apesar da eficácia demonstrada, a tecnologia apresenta limitações. A presença da assinatura digital não atesta de forma absoluta que a totalidade de um texto foi redigida pelo ChatGPT, tampouco quantifica a parcela de intervenção humana. Em avaliações com taxa de 1% de falsos positivos, o detector identificou a marca em cerca de 80% de trechos com 200 tokens, subindo para aproximadamente 95% em passagens com 400 tokens.

Alterações manuais no texto reduzem drasticamente as chances de detecção. Experimentos indicam que a substituição de 10% das palavras por sinônimos derruba a taxa de identificação para 66%, enquanto a troca de 25% reduz o índice para 17%. Devido a essas margens de erro e ao risco de falsos positivos, a ferramenta de detecção não será liberada ao público geral de imediato, ficando restrita inicialmente a pesquisadores, organizações especializadas e autoridades devidamente aprovadas.

No Brasil e em outras regiões fora do bloco europeu, os usuários comuns não receberão o recurso de forma automática na interface do ChatGPT nesta fase inicial, embora clientes da API globalmente já possam ativar a tecnologia de forma voluntária em modelos compatíveis.

Com informações: Canaltech — ver matéria original

Esta matéria foi produzida com apoio de inteligência artificial e revisada por um jornalista antes da publicação.