A OpenAI vai embutir marcas d'água invisíveis nos textos do ChatGPT e do Codex na União Europeia e abrir um detector para pesquisadores selecionados. A empresa admite que a tecnologia reconhece textos longos e pouco editados muito melhor do que respostas curtas.
Por que a OpenAI marca textos agora
A Lei de Inteligência Artificial da União Europeia exige que os provedores de IA generativa tornem o texto gerado identificável de forma legível por máquina. A OpenAI publicou sua abordagem em 5 de outubro para atender a essa regra, e o prazo está amarrado ao Artigo 50, a cláusula de transparência que passa a valer em 2 de agosto de 2026, com data limite de 2 de dezembro de 2026 para sistemas já no mercado.
O plano tem três partes. Clientes da API em todo o mundo podem aderir à marca d'água de texto para modelos selecionados a partir de agora, e ela fica desligada por padrão. Nas próximas semanas, a OpenAI vai adicionar uma marca d'água invisível à saída de texto elegível do ChatGPT e do Codex na União Europeia. E a empresa abre inscrições para o seu detector de marcas d'água, limitado no início a pesquisadores aprovados e organizações especializadas.
Esse último detalhe define o quanto o sistema é útil na prática. Usuários comuns e a maioria das plataformas não vão conseguir checar um trecho sozinhos, pelo menos por enquanto. A marcação fica no lado da saída. A verificação segue atrás de uma porta, enquanto a OpenAI avalia a confiabilidade.
Como o textGrain embute a marca d'água no texto do ChatGPT
A OpenAI chama o método de textGrain. Ele adiciona um sinal estatístico invisível às palavras que o modelo escolhe. Nada na frase parece diferente para quem lê. O detector, no entanto, conhece o padrão e confere se um trecho carrega a marca.
A verificação de áudio e imagem já funciona por ferramentas públicas como a página openai.com/verify e a Content Provenance API, e essas seguem abertas a qualquer pessoa. O texto é o problema mais difícil. Não há um arquivo onde encaixar uma assinatura.
Onde a marca d'água perde força
A OpenAI é incomumente direta sobre os limites. Nas próprias avaliações, com taxa alvo de 1% de falso positivo, o detector identificou a marca em cerca de 80% dos trechos de 200 tokens e em cerca de 95% dos trechos de 400 tokens, em conteúdo como psicologia. A detecção cai bastante em matemática, onde há menos liberdade para escolher palavras.
Editar enfraquece o sinal rápido. Em trechos de 400 tokens, trocar 10% das palavras por sinônimos derrubou a detecção de cerca de 92% para 66%. Trocando um quarto, cai para 17%.
Cenário | Taxa de detecção |
|---|---|
Trecho de 200 tokens | cerca de 80% |
Trecho de 400 tokens | cerca de 95% |
400 tokens, 10% das palavras trocadas | cerca de 66% |
400 tokens, 25% das palavras trocadas | cerca de 17% |
A conclusão para quem espera flagrar texto de IA: respostas curtas, escrita cheia de fórmulas e trechos levemente parafraseados são exatamente os casos em que a marca d'água dá o menor sinal. A OpenAI diz que testou o textGrain contra outros métodos, incluindo o SynthID for text, do Google, e que ele empatou ou superou esses rivais em condições ideais, com o aviso de que um bom desempenho de laboratório não garante detecção confiável no dia a dia.
O que o detector muda para pesquisadores e leitores
O detector importa porque uma marca d'água só ajuda se alguém conseguir ler o sinal. A OpenAI está limitando o acesso inicial a pesquisadores e organizações especializadas que possam ajudar a testar a confiabilidade e definir usos responsáveis.
Há um ângulo de privacidade que vale nomear. A proveniência pode confirmar que alguém recorreu a um assistente de IA, mesmo em situações em que esse uso é legal, privado ou comercialmente sensível. Uma marca d'água também não diz se o texto é verdadeiro. Um humano pode escrever falsidades. Um modelo pode produzir linhas corretas. Tudo o que o sinal faz é sugerir de onde o texto veio.
A marca d'água de texto é confiável o bastante para o AI Act?
A OpenAI trata a marca d'água de texto como uma tecnologia inicial, com limites reais, e a implementação em fases reflete isso. A adesão opcional para clientes da API e o acesso restrito ao detector são duas reservas, não descuidos.
Quem constrói sobre a API tem um interruptor que pode ligar, e ele permanece desligado a menos que seja ativado. Quem usa o ChatGPT na UE deve esperar a marca invisível chegar nas próximas semanas, percebendo ou não. Para todos os outros, a pergunta prática é se um sinal que se apaga sob edição leve consegue carregar o peso que a lei pede. A OpenAI diz que pretende abrir o código da tecnologia para que outros construam sobre ela, o que pode ajudar a responder isso com o tempo.






