Le nouveau mécanisme de Claude transforme une vieille question en problème de produit : un texte généré par IA peut-il être identifié de façon lisible par une machine ?
QbitAI a rapporté le 11 août qu’Anthropic ajoute des marques invisibles aux contenus générés par Claude. Selon la page d’aide d’Anthropic, les modèles Claude lancés dans l’Union européenne à partir du 2 août prennent en charge un marquage lisible par machine dès le premier jour.
La formulation officielle est concise :
Generated text will carry embedded watermarksPour l’utilisateur, cela signifie qu’un texte de Claude peut contenir un signal invisible qui survit à la copie, au collage et à de légères modifications.
Le signal entre dans la couche du modèle
Le périmètre est large : Claude, Claude Platform API, Claude Code, Claude Cowork et Claude Tag, ainsi que les accès via AWS, Google Cloud et Microsoft Foundry. Le marquage s’applique dans les régions où Claude est proposé.
La réponse de conformité de Claude va plus loin qu’un simple avertissement visuel. Un avertissement informe des personnes. Un signal dans la sortie du modèle fournit une entrée à la détection automatique. Pour les grandes plateformes, cela facilite la modération ; pour les créateurs, cela augmente aussi le coût des faux positifs.
La loi européenne fixe l’échéance
Le contexte est l’article 50 de l’EU AI Act. Cloud Security Alliance répartit ses obligations de transparence en quatre groupes : les systèmes interactifs doivent informer l’utilisateur qu’il interagit avec une IA ; les systèmes générant audio, image, vidéo ou texte doivent marquer la sortie de façon lisible par machine.
Les obligations de transparence de l’article 50 s’appliquent depuis le 2 août. Pour les systèmes déjà sur le marché, l’obligation de filigrane dispose d’une période de transition ; CSA et The Verge mentionnent une fenêtre jusqu’au 2 décembre pour les anciens produits.
La détection ne prouve pas l’auteur
Détecter une marque Claude indique seulement que le contenu a pu passer par Claude ; cela ne prouve pas à lui seul que Claude en est l’auteur original. Un texte écrit par une personne puis corrigé, traduit, résumé ou formaté par Claude peut aussi laisser un signal. À l’inverse, l’absence de marque ne prouve pas l’absence d’IA.
Plus le filigrane devient officiel, plus ses limites doivent être explicites. Il réduit le coût de la pure supposition, mais crée de nouvelles zones grises. Anthropic n’a pas encore publié l’algorithme de filigrane textuel ni la documentation technique de détection. Les entreprises devraient traiter le résultat comme un signal de risque, pas comme un verdict.
Sources : QbitAI, Anthropic Claude Help Center, The Verge, Cloud Security Alliance, CocoLoop, iThome ; vérification du périmètre des modèles, des points d’accès produit, du cloud, des types de fichiers C2PA, des obligations de l’article 50, de la transition des anciens modèles, des limites de détection et de l’absence de documentation technique publique.