Principais destaques
- Marca d’água invisível: textos gerados pelo ChatGPT e pelo Codex passarão a carregar um padrão detectável, sem alterar visualmente o conteúdo.
- Obrigação europeia: a mudança será implementada nas próximas semanas para usuários elegíveis da União Europeia, em todos os planos.
- Detecção tem limites: pequenas edições, textos curtos, matemática e traduções podem dificultar a identificação, então a ausência da marca não prova que um texto foi escrito por uma pessoa.
A OpenAI vai começar a colocar uma espécie de assinatura invisível nos textos produzidos pelo ChatGPT e pelo Codex para usuários da União Europeia. A medida faz parte da adaptação da empresa às novas regras de transparência do AI Act europeu.
A diferença é que ninguém verá um símbolo, uma etiqueta ou qualquer indicação explícita no texto.
A marca estará escondida nas próprias palavras.
Não é uma marca d’água como a de uma imagem 🫥
A tecnologia desenvolvida pela OpenAI, chamada textGrain, funciona modificando sutilmente as escolhas de palavras feitas pelo modelo durante a geração do conteúdo.
O resultado continua parecendo um texto normal para quem lê. A diferença aparece apenas quando um sistema de detecção procura pelo padrão estatístico deixado pela IA.
🔎 O truque está na escolha das palavras: em vez de inserir um caractere ou código visível, o sistema influencia discretamente quais palavras o modelo escolhe entre as possibilidades disponíveis.
A OpenAI explica que a técnica utiliza uma chave secreta para organizar as previsões de próximas palavras. Quando centenas dessas pequenas decisões são acumuladas em um texto, um detector pode identificar o padrão.
E existe uma vantagem importante: como a informação está incorporada ao próprio texto, ela acompanha o conteúdo quando ele é copiado e colado.
💡 A ideia é transformar o próprio texto em uma espécie de impressão digital estatística, sem colocar uma etiqueta visível dizendo que ele foi criado por IA.
Por que a Europa está exigindo isso? 🇪🇺
A mudança está ligada às regras de transparência do AI Act, que passaram a exigir mecanismos capazes de identificar conteúdo gerado ou manipulado por inteligência artificial.
A OpenAI afirma que o recurso começará a ser disponibilizado nas próximas semanas para usuários elegíveis do ChatGPT e do Codex na União Europeia, independentemente do plano contratado.
Fora da Europa, a história é diferente.
Desenvolvedores que utilizam a API da OpenAI poderão ativar o sistema em determinados modelos a partir de agora, em qualquer lugar do mundo. A função, porém, ficará desativada por padrão.
A empresa também deixou claro que não pretende transformar a marca d’água em um padrão global neste primeiro momento.
E o texto continua sendo seu?
A OpenAI afirma que o watermark não identifica o usuário responsável pela geração do conteúdo.
Também diz não ter observado uma mudança significativa no desempenho dos modelos quando a tecnologia está ativada.
Isso é importante porque uma das preocupações em sistemas desse tipo é fazer com que o modelo passe a produzir textos artificialmente diferentes apenas para conseguir carregar a assinatura.
A proposta da textGrain é justamente evitar isso.
Mas dá para apagar a marca? Sim, até certo ponto ✏️
Aqui aparece uma das limitações mais interessantes da tecnologia.
Nos testes divulgados pela OpenAI, substituir apenas 10% das palavras por sinônimos fez a taxa de detecção cair de aproximadamente 92% para 66%.
Ou seja, a marca não é exatamente indestrutível.
Uma edição relativamente pequena já pode reduzir consideravelmente a capacidade do detector de reconhecer o padrão.
⚠️ E há outros pontos fracos: textos muito curtos, respostas matemáticas e conteúdos traduzidos também são mais difíceis de identificar.
Isso significa que o sistema deve funcionar melhor quando existe uma quantidade razoável de texto original produzido pelo modelo.
A ausência da marca não significa “foi escrito por humano”
Esse detalhe pode evitar uma série de interpretações erradas.
A própria OpenAI alerta que não encontrar a marca d’água não comprova autoria humana.
Um texto pode não apresentar o padrão porque é curto demais, porque sofreu muitas alterações ou simplesmente porque foi produzido por outro sistema de inteligência artificial.
A tecnologia também não consegue dizer quanto trabalho humano existiu no processo.
Uma pessoa pode pedir ao ChatGPT para produzir um primeiro rascunho, modificar praticamente cada parágrafo, acrescentar informações próprias e reescrever o resultado.
O detector poderia indicar que houve participação de um sistema da OpenAI, mas isso não significa que a IA tenha sido responsável por todo o conteúdo.
Isso complica a vida de quem usa IA no trabalho? 💼
A discussão promete ser especialmente sensível em ambientes acadêmicos e profissionais.
A marca d’água pode facilitar investigações sobre o uso de IA, mas também levanta uma questão mais complicada: qual é exatamente a fronteira entre conteúdo produzido por uma IA e conteúdo produzido por uma pessoa com auxílio de IA?
A Anthropic já anunciou uma iniciativa semelhante para textos gerados pelo Claude, mas com uma diferença importante: a empresa pretende aplicar o sistema globalmente.
A decisão provocou reações de usuários que argumentam que forneceram as instruções, o contexto e as decisões criativas, enquanto o modelo teria funcionado apenas como ferramenta.
A OpenAI já tinha essa tecnologia
A novidade também não surgiu do nada.
A OpenAI já havia desenvolvido um sistema de marcação para textos gerados por IA, mas decidiu não lançá-lo anteriormente. Entre as preocupações estava a possibilidade de usuários migrarem para concorrentes que não utilizassem marcas d’água.
Agora, a pressão regulatória europeia muda o cálculo.
A OpenAI publicou também um relatório técnico detalhando o funcionamento do textGrain, desenvolvido em parceria com pesquisadores da University of Pennsylvania e da Yale University.
O acesso ao detector, porém, não será aberto imediatamente para qualquer pessoa.
🧪 Primeiro vem a fase de testes: a empresa pretende disponibilizar o mecanismo inicialmente apenas para pesquisadores aprovados e organizações especializadas, justamente para avaliar sua confiabilidade e seus usos responsáveis.
Uma corrida silenciosa entre os grandes modelos
A movimentação coloca OpenAI dentro de uma tendência maior.
Anthropic, Google, Meta, Microsoft e OpenAI estão entre as empresas que se comprometeram com o código europeu de práticas para transparência de conteúdo gerado por IA.
Isso pode transformar a marcação de conteúdo em uma camada cada vez mais comum dos sistemas generativos.
O curioso é que ela não precisa aparecer na tela.
Para o usuário, o texto continuará sendo simplesmente um texto. Para um detector que conhece a chave e sabe o que procurar, entretanto, haverá uma espécie de rastro estatístico escondido entre as palavras.
E talvez esse seja o verdadeiro teste para a tecnologia: não apenas conseguir marcar um texto antes que ele seja publicado, mas continuar reconhecível depois que uma pessoa fizer aquilo que sempre fez com um texto de IA: copiar, editar, cortar, reescrever e colocar um pouco de si no meio.
