Durante dois anos, a OpenAI desenvolveu em silêncio uma marca d'água invisível capaz de identificar textos gerados pelo ChatGPT — uma resposta técnica a uma questão que vai muito além da técnica. A empresa hesita em lançar a ferramenta não por incapacidade, mas por consciência: a solução é facilmente contornável por quem age de má-fé, e pode penalizar desproporcionalmente quem usa a IA de forma legítima, como os falantes não nativos de inglês. É o retrato de uma era em que as ferramentas chegam antes das respostas éticas que deveriam guiá-las.
OpenAI desenvolve ferramenta para detetar textos gerados pelo ChatGPT
Fácil para contornar por atores mal-intencionados
Então a OpenAI tem uma forma de apanhar quem usa o ChatGPT para escrever, mas não quer lançá-la?
Tem uma forma que funciona em teoria, sim. Mas reconhece que é fácil de contornar e que poderia prejudicar pessoas que usam a IA legitimamente.
Espera — se é fácil de contornar, qual é o ponto? Porque é que alguém confiaria nisto?
Boa pergunta. Funciona contra alterações pequenas e desorganizadas. Mas contra alguém que realmente quer esconder, falha.
E a questão dos falantes não nativos — isso é uma preocupação real ou é uma desculpa?
A OpenAI levantou-a oficialmente. Para alguém que não é nativo, o ChatGPT é uma ferramenta de acessibilidade. Marcar tudo como suspeito criaria discriminação.
Mas ninguém está a dizer que é discriminação intencional. É apenas o efeito colateral de uma ferramenta de deteção.
Exatamente. O que torna o problema mais difícil de resolver. Não é malícia — é estrutura.
Então qual é o cenário mais provável? Lançam ou não?
A hesitação da OpenAI sugere que ainda não encontraram uma resposta que se sinta certa.
E enquanto isso, as escolas e as empresas continuam sem saber se um texto é genuíno ou não.
Sim. O problema real permanece sem solução.
O Pulso
- A OpenAI tem uma ferramenta funcional para detetar textos do ChatGPT, mas mantém-na guardada — a tensão entre capacidade técnica e responsabilidade moral está no centro desta história.
- O método é elegante: pequenas alterações invisíveis na escolha de palavras criam um padrão detetável, superando todas as tentativas anteriores que falharam por imprecisão.
- A vulnerabilidade é crítica — traduzir o texto, reformulá-lo com outro modelo ou inserir e remover caracteres especiais é suficiente para destruir a marca d'água completamente.
- A preocupação mais profunda não é técnica: a ferramenta poderia estigmatizar falantes não nativos de inglês que usam o ChatGPT como assistente legítimo de escrita.
- A OpenAI encontra-se num impasse revelador — tem uma solução que funciona, reconhece que é insuficiente, e ainda não decidiu se o lançamento faz mais bem do que mal.
Durante dois anos, a OpenAI desenvolveu em silêncio uma marca d'água invisível capaz de identificar textos gerados pelo ChatGPT — uma resposta técnica a uma questão que vai muito além da técnica. A empresa hesita em lançar a ferramenta não por incapacidade, mas por consciência: a solução é facilmente contornável por quem age de má-fé, e pode penalizar desproporcionalmente quem usa a IA de forma legítima, como os falantes não nativos de inglês. É o retrato de uma era em que as ferramentas chegam antes das respostas éticas que deveriam guiá-las.
A OpenAI tem uma ferramenta quase pronta para identificar textos gerados pelo ChatGPT — e está hesitante em lançá-la. O dilema não é técnico. É moral, e também prático.
Desenvolvido ao longo de dois anos, o método funciona de forma subtil: o ChatGPT introduz pequenas alterações invisíveis na seleção de palavras enquanto escreve, criando um padrão que uma ferramenta separada pode depois detetar, como uma marca d'água que só aparece sob certa luz. É uma abordagem diferente de tudo o que se tentou antes — as soluções anteriores falharam sistematicamente, com precisão tão baixa que eram praticamente inúteis.
O Wall Street Journal revelou a existência do projeto, e a OpenAI atualizou publicamente um post do seu blogue, sendo honesta sobre as limitações. A marca d'água resiste a pequenas paráfrases, mas desmorona-se perante ataques mais simples do que se poderia esperar: passar o texto por um tradutor automático, reformulá-lo com outro modelo de IA, ou até inserir e remover manualmente um caractere especial são suficientes para a destruir. A própria empresa reconhece que o método é "fácil de contornar por atores mal-intencionados".
Mas há uma preocupação talvez mais profunda. Para quem não cresceu a falar inglês, o ChatGPT é um assistente legítimo — ajuda a polir a gramática, a estruturar ideias, a ganhar confiança na escrita. Um sistema que marca automaticamente esses textos como suspeitos criaria uma injustiça silenciosa: penalizaria precisamente quem usa a ferramenta de forma honesta.
O resultado é uma empresa com uma solução que funciona tecnicamente, mas que reconhece ser facilmente contornável e potencialmente discriminatória. A hesitação da OpenAI não é indecisão — é o sinal de que o problema é mais complicado do que qualquer ferramenta pode resolver sozinha.
A OpenAI tem uma ferramenta pronta — ou quase pronta — que poderia identificar quando alguém usa o ChatGPT para escrever um artigo escolar, um relatório profissional, ou qualquer outro texto que deveria ser seu. Mas a empresa está hesitante em lançá-la. O dilema não é técnico. É moral, e também prático.
O método em desenvolvimento há dois anos funciona de forma elegante: o ChatGPT faz pequenas alterações invisíveis na forma como escolhe as palavras enquanto escreve. Não muda o significado. Não deixa marcas visíveis. Apenas cria um padrão subtil que uma ferramenta separada poderia depois detetar — como uma marca d'água que só aparece sob certa luz. Isto é diferente de tudo o que se tentou antes. As tentativas anteriores de detetar texto gerado por IA falharam sistematicamente, com precisão tão baixa que eram praticamente inúteis.
O Wall Street Journal revelou a existência deste projeto, e logo depois a OpenAI atualizou um post do seu blogue de maio onde discute a identificação de conteúdo gerado por IA. A atualização é honesta sobre as limitações. A marca d'água funciona bem contra pequenas alterações — se alguém parafrasear um parágrafo aqui e ali, a marca permanece detetável. Mas desmorona-se contra ataques mais sofisticados. Passar o texto por um tradutor automático e depois traduzir de volta. Reformular tudo com outro modelo de IA. Até algo tão simples como pedir ao ChatGPT para inserir um caractere especial entre cada palavra e depois removê-lo manualmente. Qualquer destas técnicas destrói a marca d'água. A OpenAI reconhece isto abertamente: o método é "fácil para contornar por atores mal-intencionados".
Mas há outra preocupação, talvez mais profunda. A OpenAI nota que uma ferramenta assim poderia "estigmatizar o uso da IA como uma ferramenta de escrita útil para falantes não nativos de inglês". Isto toca num ponto real. Para alguém que não cresceu a falar inglês, o ChatGPT é um assistente legítimo — ajuda a polir a gramática, a estruturar ideias, a ganhar confiança. Marcar automaticamente todo o texto que passa pelo ChatGPT como suspeito criaria um sistema onde os falantes não nativos seriam penalizados por usar uma ferramenta que os torna mais capazes.
O resultado é uma empresa com uma solução que funciona tecnicamente, mas que reconhece ser facilmente contornável e potencialmente injusta. Não é claro se a OpenAI vai lançá-la. A hesitação não é indecisão — é o sinal de que o problema é mais complicado do que uma ferramenta pode resolver.
Citações Notáveis
A marca d'água de texto provou ser altamente precisa contra adulteração localizada, como paráfrase, mas menos robusta contra adulteração globalizada— OpenAI, atualização do blogue
A ferramenta poderia estigmatizar o uso da IA como uma ferramenta de escrita útil para falantes não nativos de inglês— OpenAI, atualização do blogue