A OpenAI vai começar a incluir um sinal invisível e legível por máquinas em determinados textos produzidos pelo ChatGPT e pelo Codex na União Europeia. A tecnologia, chamada textGrain, será aplicada gradualmente nas próximas semanas e pretende ajudar investigadores e entidades especializadas a reconhecer conteúdo gerado pelos modelos da empresa.
A mudança resulta dos compromissos assumidos no âmbito do Código de Práticas para modelos de inteligência artificial de finalidade geral da União Europeia. Para quem usa estas ferramentas, o texto continuará a parecer normal: a marca não acrescenta etiquetas visíveis, símbolos ou avisos no ecrã.
Como funciona a marca textGrain
O sistema altera discretamente a escolha de palavras durante a geração do texto, criando um padrão estatístico que pode ser procurado por um detetor próprio. A OpenAI descreve-o como uma marca de água para texto, mas sublinha que não inclui dados sobre a identidade do utilizador.
A presença do sinal também não prova quem escreveu, editou ou publicou o conteúdo. Serve apenas como indicação técnica de que o texto poderá ter sido produzido por um modelo compatível. A empresa afirma que o método foi concebido para não mudar de forma relevante a qualidade das respostas.
O acesso ao detetor não ficará disponível para qualquer pessoa numa primeira fase. A OpenAI prevê disponibilizá-lo a investigadores aprovados e organizações especializadas, uma opção que procura limitar abusos e conclusões precipitadas.
O sinal pode desaparecer com alterações
A própria empresa reconhece que nenhuma técnica deste tipo é infalível. A deteção funciona melhor em textos longos e pouco modificados, mas perde eficácia quando o conteúdo é curto, traduzido, resumido ou reescrito. Trocar palavras por sinónimos também pode enfraquecer o padrão.
Esta limitação é importante porque a marca não deve ser usada, isoladamente, para acusar alguém de ter recorrido a inteligência artificial. Um resultado positivo não estabelece autoria, intenção ou rigor factual. Da mesma forma, um resultado negativo não garante que o texto tenha sido escrito sem ajuda de um modelo.
A implementação europeia será ativada por defeito nos produtos ChatGPT e Codex quando os critérios técnicos forem cumpridos. Na API, a OpenAI vai oferecer a tecnologia como opção para alguns modelos a nível global, permitindo que os programadores decidam se querem incorporá-la nas suas aplicações.
Transparência sem rótulo visível
A iniciativa tenta resolver um problema difícil: tornar o conteúdo sintético mais identificável sem alterar a experiência de leitura. Ao contrário de metadados anexados a uma imagem ou ficheiro, um texto pode ser copiado e colado para qualquer plataforma. O padrão tem, por isso, de sobreviver no próprio conjunto de palavras.
Este desenho procura equilibrar transparência e privacidade. Ainda assim, a utilidade real dependerá da quantidade de texto disponível, das alterações posteriores e da forma como os resultados forem interpretados por quem tiver acesso ao detetor.
O lançamento poderá ajudar estudos sobre a circulação de conteúdo gerado por IA, mas não substitui verificação editorial, contexto ou análise humana. A OpenAI promete continuar a avaliar a resistência da técnica a manipulações e a publicar informação sobre o seu desempenho à medida que a implementação avança.
Fontes: OpenAI · The Verge · Ars Technica
