A OpenAI começará a adicionar uma marca d’água invisível a textos gerados pelo ChatGPT e pelo Codex na União Europeia. A medida foi anunciada nesta segunda-feira (5) e deve ser implementada nas próximas semanas para usuários elegíveis.
A iniciativa faz parte da adequação às regras de transparência do EU AI Act, que exigem que conteúdos produzidos por inteligência artificial possam ser identificados por outros sistemas. A tecnologia será aplicada aos usuários do ChatGPT e do Codex em todos os planos na União Europeia.
Para desenvolvedores que utilizam a API da OpenAI, a marca d’água estará disponível globalmente para determinados modelos a partir desta segunda-feira, mas ficará desativada por padrão. A empresa informou que não pretende tornar o recurso um padrão global neste primeiro momento.
A marca d’água não aparece como símbolo ou elemento visível no conteúdo. Segundo a OpenAI, o sistema altera sutilmente as escolhas de palavras feitas pelo modelo, criando um padrão estatístico que pode ser identificado por uma ferramenta específica de detecção.
Chamada textGrain, a tecnologia fica incorporada ao próprio texto. Por isso, o sinal acompanha o conteúdo quando ele é copiado e colado. A OpenAI afirma que a marca d’água não identifica o usuário e que seus testes não apontaram mudanças significativas no desempenho dos modelos com o recurso ativado.
A empresa também divulgou um relatório técnico sobre o funcionamento do sistema. O método utiliza uma chave secreta para organizar as previsões das próximas palavras do modelo. A aplicação repetida dessas alterações permite que um detector procure o padrão no texto e avalie se ele contém uma marca d’água da OpenAI.
A própria empresa reconhece, porém, que a tecnologia tem limitações. Em um dos testes, a substituição de 10% das palavras por sinônimos fez a taxa de detecção cair de aproximadamente 92% para 66%.
A OpenAI também afirma que textos curtos, respostas de matemática e conteúdos traduzidos são mais difíceis de identificar. De acordo com os testes apresentados, a detecção melhora conforme aumenta a quantidade de texto analisado.
A ausência de uma marca d’água, por outro lado, não comprova que um texto foi escrito por uma pessoa. O conteúdo pode ser curto demais, ter passado por muitas alterações ou ter sido produzido por uma ferramenta de inteligência artificial de outra empresa.
A companhia ressalta ainda que o sinal não permite determinar o nível de participação humana na produção do texto. A detecção pode indicar que um sistema da OpenAI gerou ou processou parte de um conteúdo, mas não revela quanto de julgamento, edição ou criatividade humana foi empregado.
Inicialmente, o detector de marcas d’água não será aberto ao público. A OpenAI decidiu limitar o acesso a pesquisadores aprovados e organizações especializadas, com o objetivo de avaliar a confiabilidade da tecnologia e seus usos responsáveis.
A ferramenta informará apenas se identificou uma marca d’água da OpenAI. Ela não revelará o usuário, os prompts utilizados ou as conversas relacionadas ao conteúdo.
A restrição considera a possibilidade de falsos positivos e falsos negativos. A OpenAI afirma que pretende revisar sua abordagem conforme a tecnologia, os padrões e as evidências sobre o funcionamento das marcas d’água evoluírem. A empresa também planeja disponibilizar a tecnologia em código aberto para que outras organizações possam desenvolver soluções baseadas nela.
A OpenAI reforça que a marca d’água tem uma função limitada. Ela não determina quem é o proprietário do texto, se o uso do conteúdo é legal ou quem deve ser responsabilizado por ele.
O sistema também não verifica se uma informação é verdadeira, enganosa, prejudicial ou apresentada no contexto correto. Para a empresa, essas limitações precisam ser consideradas na interpretação dos resultados de detecção.











