Claude passa a marcar texto com watermark invisível

O novo mecanismo do Claude transforma uma pergunta antiga em questão de produto: textos gerados por IA podem ser identificados por máquinas de forma confiável?

A QbitAI informou em 11 de agosto que a Anthropic está adicionando marcas invisíveis a conteúdos gerados pelo Claude. Segundo a página de ajuda da Anthropic, modelos Claude lançados na União Europeia a partir de 2 de agosto já suportam marcação legível por máquina desde o primeiro dia.

A frase oficial é curta:

Generated text will carry embedded watermarks
Em linguagem de usuário, isso significa que um texto do Claude pode carregar um sinal invisível que sobrevive a copiar, colar e pequenas edições.

O watermark entra na camada do modelo

O escopo é amplo: Claude, Claude Platform API, Claude Code, Claude Cowork e Claude Tag, além de acesso via AWS, Google Cloud e Microsoft Foundry. A marcação vale nas regiões em que o Claude é oferecido.

A resposta de compliance do Claude vai além de um aviso visual. Um aviso informa pessoas. Um sinal na saída do modelo cria entrada para detecção automática. Para grandes plataformas, isso é mais fácil de colocar em moderação; para criadores, também aumenta o custo de falsos positivos.

A lei europeia definiu o prazo

O pano de fundo é o Artigo 50 do EU AI Act. A Cloud Security Alliance divide as obrigações de transparência em quatro grupos: sistemas interativos devem avisar que o usuário fala com IA; sistemas que geram áudio, imagem, vídeo ou texto devem marcar a saída de forma legível por máquina.

As obrigações de transparência do Artigo 50 começaram a valer em 2 de agosto. Para sistemas já no mercado, há uma janela de transição para a obrigação de watermark; CSA e The Verge citam prazo até 2 de dezembro para produtos antigos.

Detecção não prova autoria

Detectar uma marca do Claude apenas indica que o conteúdo pode ter passado pelo Claude; não prova sozinho que Claude foi o autor original. Um texto escrito por uma pessoa e depois revisado, traduzido, resumido ou formatado pelo Claude também pode carregar o sinal. O inverso também vale: ausência de marca não prova ausência de IA.

Quanto mais oficial o watermark, mais claros precisam ser seus limites. Ele reduz o custo de adivinhação, mas cria novas áreas cinzentas. A Anthropic ainda não publicou o algoritmo de watermark textual nem documentação técnica de detecção. Empresas devem tratar o resultado como sinal de risco, não como veredito.

Fontes: QbitAI, Anthropic Claude Help Center, The Verge, Cloud Security Alliance, CocoLoop, iThome; verificados escopo de modelos, entradas de produto, nuvem, tipos de arquivo C2PA, obrigações do Artigo 50, janela de transição para modelos antigos, limites de detecção e estado não publicado da documentação técnica.