OpenAI adota marca d'água invisível em textos do ChatGPT para cumprir lei europeia

A marca não revela quem usou a IA, apenas que ela participou
A tecnologia invisível da OpenAI identifica conteúdo gerado por IA, mas não rastreia usuários ou responsabilidade.
Mark

Por que a OpenAI está fazendo isso agora? Parece uma resposta reativa à lei europeia.

Mimi

Exatamente. O AI Act europeu exige que conteúdo gerado por IA seja identificável de forma legível por máquinas. A OpenAI está se antecipando para estar em conformidade quando a lei entrar em vigor.

Luke

Mas vale notar que isso é apenas para a União Europeia. Globalmente, a empresa não está implementando isso ainda. É uma resposta regulatória específica, não uma mudança de política geral.

Mark

Como funciona tecnicamente? É algo que os usuários vão notar?

Mimi

Não, é invisível. A marca d'água está embutida nas escolhas de palavras que o modelo faz. Um detector consegue depois verificar se o sinal está lá.

Luke

Mas aqui está o problema: em textos de 400 tokens, funciona com 95% de precisão. Em textos matemáticos, cai drasticamente. E se alguém editar 25% das palavras, a detecção cai para 17%. Isso não é tão robusto quanto parece.

Mark

Então a marca d'água pode ser facilmente removida?

Mimi

Não removida, mas enfraquecida. Se você editar o texto, a marca fica menos confiável. É por isso que a OpenAI está restringindo o acesso ao detector apenas a pesquisadores aprovados.

Luke

E isso levanta uma questão: se a tecnologia é tão frágil, qual é o ponto real? A lei europeia quer identificação confiável. Isso entrega?

Mark

A marca d'água identifica quem escreveu o texto?

Mimi

Não. Ela só diz que um modelo da OpenAI participou da geração. Não revela o usuário, a conta, o prompt ou a conversa.

Luke

E isso é importante porque significa que a marca d'água não é uma ferramenta de rastreamento de usuários. É puramente sobre identificar se IA foi envolvida, não quem a usou.

Mark

E se o texto foi editado por um humano depois? A marca ainda funciona?

Mimi

Funciona, mas com menos confiabilidade. Um texto pode ter sido gerado pela IA e depois revisado ou complementado por uma pessoa. A marca não distingue isso.

Luke

Então a marca não diz nada sobre quanto de trabalho humano realmente entrou naquilo. Alguém pode ter apenas corrigido uma vírgula e o texto ainda teria a marca.

Mark

A Anthropic está fazendo algo parecido?

Mimi

Sim, desde agosto. O Claude também tem marca d'água invisível. Mas a Anthropic fez a mesma ressalva: a marca não é prova definitiva de que o texto foi originalmente criado por IA.

Luke

Ambas as empresas estão sendo honestas sobre as limitações. Mas isso também significa que nenhuma delas está oferecendo uma solução perfeita para o que a lei europeia está pedindo.

  • A pressão regulatória europeia forçou a OpenAI a agir: o AI Act exige que conteúdo gerado por IA seja identificável por máquinas, e a empresa não tinha escolha senão cumprir.
  • A tecnologia textGrain atinge até 95% de precisão em textos mais longos, mas desmorona diante de conteúdo matemático, traduções e edições simples — trocar 25% das palavras derruba a detecção para apenas 17%.
  • O acesso ao detector será restrito a pesquisadores aprovados, sinalizando que a OpenAI reconhece as fragilidades da solução antes de expô-la ao escrutínio público amplo.
  • A marca d'água não revela usuários, não prova autoria humana e não determina veracidade — sua ausência também não garante que um texto foi escrito por uma pessoa.
  • A Anthropic já havia trilhado caminho semelhante em agosto, e ambas as empresas convergem na mesma advertência: essas marcas são um avanço, não uma solução definitiva.

Num momento em que a fronteira entre a escrita humana e a gerada por máquinas se torna cada vez mais difusa, a OpenAI anunciou a adoção de marcas d'água invisíveis nos textos do ChatGPT, respondendo às exigências do AI Act europeu. A tecnologia, chamada textGrain, insere sinais estatísticos silenciosos nas escolhas de palavras do modelo — uma espécie de impressão digital que não se vê, mas que pode ser detectada. É um passo cauteloso numa longa jornada: a ferramenta funciona, mas com limites, e a humanidade ainda busca formas de reconhecer a si mesma no espelho digital que ajudou a construir.

A OpenAI anunciou nesta segunda-feira a incorporação de marcas d'água invisíveis aos textos gerados pelo ChatGPT, seguindo os passos da Anthropic, que havia feito movimento semelhante em agosto com o Claude. A decisão responde diretamente ao AI Act, a legislação europeia que obriga os criadores de conteúdo gerado por IA a tornarem esse conteúdo identificável por máquinas. Por ora, a medida ficará restrita à União Europeia.

A tecnologia por trás da iniciativa chama-se textGrain. Ela insere um sinal estatístico invisível nas próprias escolhas de palavras do modelo durante a geração do texto — uma impressão digital embutida na estrutura linguística, imperceptível ao leitor, mas rastreável por um detector desenvolvido pela própria empresa. Os resultados são promissores, mas têm limites claros: em textos de 400 tokens, a precisão chega a 95%, mas cai drasticamente em conteúdo matemático e se enfraquece com edições. Substituir 25% das palavras por sinônimos reduz a detecção a apenas 17%.

Por causa dessas fragilidades, o acesso ao detector será inicialmente restrito a pesquisadores e organizações aprovadas pela OpenAI. Clientes da API poderão optar pela tecnologia a partir desta segunda-feira, embora ela permaneça desativada por padrão. A empresa também planeja disponibilizar o sistema em código aberto no futuro.

É igualmente importante compreender o que a marca d'água não faz: ela não identifica usuários, não revela prompts, não mede a participação humana no texto e não determina se uma informação é verdadeira ou enganosa. A ausência da marca tampouco prova autoria humana. A OpenAI reconhece que a tecnologia ainda exige refinamento significativo e promete reavaliar sua estratégia conforme novas evidências surgirem — um reconhecimento honesto de que este é um primeiro passo, não uma linha de chegada.

A OpenAI anunciou nesta segunda-feira que incorporará marcas d'água invisíveis aos textos gerados pelo ChatGPT, uma decisão que segue os passos da Anthropic, que havia feito anúncio semelhante em agosto com seu modelo Claude. A medida responde a uma exigência específica: o AI Act, a legislação europeia sobre inteligência artificial que obriga os criadores de conteúdo gerado por IA a tornarem esse conteúdo identificável de forma legível por máquinas. Por enquanto, a implementação ficará restrita à União Europeia, e a empresa deixou claro que não planeja expandir a marcação para o resto do mundo neste primeiro momento.

A tecnologia por trás dessa solução chama-se textGrain. Ela funciona inserindo um sinal estatístico invisível nas escolhas de palavras que o modelo faz enquanto gera texto. Um detector desenvolvido pela própria OpenAI consegue depois analisar um texto e verificar se esse sinal está presente, confirmando assim se houve participação de um sistema da empresa na sua produção. O sinal não aparece visualmente no texto — está embutido na própria estrutura das palavras selecionadas, criando uma espécie de impressão digital estatística.

Os testes da OpenAI mostram que o textGrain funciona com razoável confiabilidade, embora com limitações claras. Em textos de 200 tokens, o detector identificou a marca em cerca de 80% dos casos, mantendo uma taxa de falsos positivos de apenas 1%. Quando o texto cresce para 400 tokens, a precisão sobe para aproximadamente 95%. Mas há um problema significativo: em conteúdos matemáticos, as taxas caem drasticamente porque há menos variedade possível nas escolhas de palavras. Além disso, edições enfraquecem a marca. Se 10% das palavras forem substituídas por sinônimos em um texto de 400 tokens, a detecção cai de cerca de 92% para 66%. Quando 25% das palavras são trocadas, o índice desaba para 17%.

Por causa dessas limitações, a OpenAI decidiu restringir inicialmente o acesso ao detector apenas a pesquisadores e organizações especializadas que a empresa aprovar. Nos próximos meses, a marcação será implementada para usuários elegíveis do ChatGPT e do Codex na União Europeia. Clientes da API da OpenAI em todo o mundo poderão optar pela tecnologia a partir desta segunda-feira, embora a marca d'água permaneça desativada por padrão e disponível apenas em modelos selecionados. A empresa também pretende disponibilizar a tecnologia em código aberto no futuro, permitindo que outros desenvolvedores construam ferramentas a partir dela.

É importante entender o que essa marca d'água não faz. Ela não revela quem utilizou a inteligência artificial, qual conta foi usada, qual prompt foi enviado ou qual conversa originou o texto. Também não indica quanto de participação humana houve na produção daquele conteúdo — um texto pode ter sido gerado pelo modelo e depois editado, revisado ou complementado por uma pessoa. A ausência da marca, por sua vez, não significa que um texto tenha sido necessariamente escrito por um ser humano. A identificação pode falhar em conteúdos muito curtos, editados, traduzidos ou produzidos por modelos que não suportam a tecnologia. A OpenAI também deixa claro que a marca d'água não serve para determinar se uma informação é verdadeira, enganosa ou prejudicial, nem estabelece propriedade ou responsabilidade legal sobre o conteúdo.

A Anthropic, que lançou sua própria solução de marca d'água em agosto, fez ressalvas semelhantes. A empresa afirmou que as marcas seriam incorporadas aos textos de maneira imperceptível e acompanhariam o conteúdo mesmo quando copiado e colado em outros lugares, mas também alertou que a presença da marca não é prova definitiva de que um texto foi originalmente criado por inteligência artificial. Um conteúdo pode receber a identificação depois de ter sido apenas revisado, traduzido, resumido ou convertido em outro formato pelo Claude.

A OpenAI afirma que pretende reavaliar sua estratégia à medida que a tecnologia evoluir e que novas evidências sobre sua eficácia forem produzidas. O que fica claro é que, embora essas marcas d'água representem um avanço na tentativa de identificar conteúdo gerado por IA, elas estão longe de ser uma solução perfeita ou definitiva. As limitações são reais, as brechas existem, e a tecnologia ainda precisa de refinamento significativo antes de poder ser considerada confiável em cenários do mundo real.

A marca d'água não permite descobrir quem utilizou a inteligência artificial, qual conta foi usada, o prompt enviado ou a conversa que originou o texto
— OpenAI
A presença da marca não é prova definitiva de que um texto foi originalmente criado por inteligência artificial
— Anthropic
Möchten Sie die ganze Geschichte? Das Original lesen bei O GLOBO ↗
Kontakt FAQ