Vous collez un texte généré par Claude dans un document professionnel, et une question vous traverse : est-ce que quelqu'un peut prouver que ce n'est pas vous qui l'avez écrit ?
Depuis qu'Anthropic a annoncé un dispositif de marquage sur ses modèles, la réponse est oui, dans une certaine mesure. Le watermark Claude est un signal invisible glissé dans le texte généré.
Il permet de calculer la probabilité que Claude en soit l'auteur, sans ajouter de caractère caché ni changer le sens d'une seule phrase.
Ce dispositif s'applique aux modèles Claude lancés après le 2 août 2026, dans le cadre du Code de bonnes pratiques européen sur la transparence des contenus générés par IA.
On vous explique comment ça fonctionne concrètement, ce qui est marqué ou pas, et ce que ça change si vous produisez du contenu seul, sans équipe juridique derrière vous.
Comment le watermark s'insère sans rien ajouter au texte
Un modèle comme Claude ne génère pas une phrase entière d'un coup. Il choisit un mot après l'autre, en sélectionnant à chaque étape parmi une liste de candidats plausibles.
Après « Le temps était froid et », les mots couvert et gris sont tout aussi valables l'un que l'autre. Le choix final ne change rien au sens de la phrase.
Dans ce genre de cas, ce choix est réglé par un tirage aléatoire, un peu comme un lancer de dé invisible à chaque mot du texte.
Le watermark ne touche pas à ce principe : il ne force jamais Claude à choisir un mot qu'il n'aurait pas choisi naturellement. Il remplace simplement la source du hasard.
Au lieu d'un tirage totalement arbitraire, Anthropic utilise une clé secrète combinée aux mots qui précèdent pour déterminer le choix.
Le résultat reste un mot que Claude aurait pu choisir de toute façon. Mais la séquence entière devient vérifiable pour qui détient la clé.
C'est ce qui permet, après coup, de calculer une probabilité que ce texte vienne de Claude, sans que rien n'ait été ajouté ni caché dedans.
Anthropic reprend une méthode publiée par Google DeepMind dans une étude scientifique en 2024, appelée SynthID-Text. Elle-même hérite d'une proposition du chercheur Scott Aaronson formulée en 2022.
Ce n'est donc pas une invention isolée d'Anthropic, mais une approche déjà testée à grande échelle sur d'autres modèles, dont Gemini.
Aucun caractère invisible n'est inséré, contrairement à ce que suggèrent certains outils qui promettent de « nettoyer » le texte de Claude.
Ces outils s'attaquent en général aux espaces zéro-largeur : des caractères unicode invisibles, parfois utilisés par d'autres systèmes de détection pour marquer un texte.
Le watermark de Claude ne repose pas sur ce mécanisme. Il vit dans le choix des mots eux-mêmes, pas dans des symboles ajoutés après coup.
Ce que ça change vraiment pour la qualité du texte
Anthropic affirme n'avoir observé aucun effet sur la créativité ou la lisibilité des réponses de Claude lors de ses tests internes.
Google DeepMind avait fait le même constat en amont, en diffusant un modèle marqué à une partie du trafic de Gemini.
En comparant les votes des utilisateurs (pouces levés ou baissés) sur les réponses marquées et non marquées, l'équipe n'a trouvé aucun écart significatif de satisfaction.
Le marquage ne produit pas non plus de token supplémentaire. Un token est l'unité de texte, souvent un mot ou un fragment de mot, que facture un modèle de langage.
Il n'y a donc ni surcoût ni ralentissement pour vous, que vous utilisiez Claude via l'interface web ou via l'API.
Pourquoi le code et les textes factuels échappent presque au marquage
Le watermark a besoin de choix arbitraires entre plusieurs formulations équivalentes pour s'installer.
Le code n'en offre presque aucun : une ligne qui calcule une somme n'a qu'une seule sortie correcte. Une variable mal nommée casse le programme.
La même logique s'applique aux passages purement factuels. Si Claude écrit « Isaac Newton's most famous work was called Principia », il n'y a qu'un seul mot juste pour compléter la phrase.
Aucune place pour un tirage aléatoire, donc aucune place pour le watermark.
Dans le code, le signal peut malgré tout se loger dans des commentaires, là où plusieurs formulations restent équivalentes. Mais son effet sur le code lui-même reste négligeable.
Relecture, traduction : deux cas radicalement différents
Si vous demandez à Claude de corriger l'orthographe et la ponctuation d'un texte que vous avez écrit vous-même, la quasi-totalité des mots restent les vôtres.
Le watermark n'a alors presque rien sur quoi s'accrocher. Selon l'ampleur des corrections, l'intervention de Claude peut rester indétectable.
Une traduction fonctionne à l'inverse. Claude choisit chaque mot du texte traduit, sans exception, puisqu'il doit reformuler l'intégralité de la phrase dans une autre langue.
Le résultat est donc marqué intégralement, et facilement identifiable comme un texte généré, même si le texte source venait entièrement de vous.
Images et fichiers : une logique de signature, pas de filigrane
Les fichiers produits par Claude, comme un .png, un .jpg ou un .svg, ne reçoivent pas le même traitement que le texte.
Ils embarquent une note signée cryptographiquement dans leurs métadonnées, au format ouvert C2PA (Coalition for Content Provenance and Authenticity).
C'est un standard de traçabilité déjà utilisé par les fabricants d'appareils photo et les logiciels de retouche, pour indiquer d'où vient une image.
Ce n'est pas un watermark au sens strict : rien n'est modifié ni dissimulé dans les pixels de l'image.
C'est une signature vérifiable par n'importe quel outil compatible avec ce standard, y compris celui qu'Anthropic prévoit de fournir.
Comme toute métadonnée, elle ne survit pas forcément à une conversion de format ou à une simple capture d'écran, sans que le contenu visuel change pour autant.
Le watermark ne remonte jamais jusqu'à vous
Ni le watermark ni la clé qui permet de le lire ne contiennent d'information sur l'identité de l'utilisateur, son organisation ou sa conversation.
Le marquage porte uniquement sur les mots choisis par le modèle. La clé répond à une seule question : est-il probable que Claude soit intervenu sur ce texte ?
Elle ne dit jamais si Claude a écrit le texte de zéro ou l'a simplement retouché.
C'est une limite importante si vous comptiez utiliser ce mécanisme pour prouver l'origine exacte d'un contenu en cas de litige.
Peut-on effacer le watermark ?
Partiellement. Une retouche légère, deux synonymes changés ou trois virgules déplacées, ne suffit pas à faire disparaître le signal statistique.
Il faut une réécriture profonde, où la quasi-totalité des mots change, pour vraiment le fragiliser.
Anthropic note elle-même qu'un texte dont chaque mot a été remplacé pose une question de fond : peut-on encore parler de contenu généré par IA à ce stade ?
La détection perd aussi en fiabilité sur un texte court, faute de suffisamment de choix de mots pour établir une probabilité solide.
Des outils en ligne se présentent comme des « watermark remover » et promettent de nettoyer le texte de caractères invisibles.
Ils s'attaquent à un problème différent : les espaces zéro-largeur ou les tirets longs que d'autres méthodes de détection utilisent parfois, pas au mécanisme statistique employé par Claude.
Contourner ce dernier suppose une réécriture manuelle complète, pas un clic sur un bouton.
Comment vérifier si un texte a été généré par Claude
Anthropic prévoit de proposer une API de détection, dont les modalités précises restent à préciser.
Elle fonctionnera différemment des détecteurs de texte IA disponibles sur le marché aujourd'hui, comme Pangram, Originality.ai ou Winston AI, qui n'ont pas accès à la clé d'Anthropic.
Ces détecteurs indépendants se basent sur les tics d'écriture propres aux modèles de langage.
Par exemple la construction « ce n'est pas X, c'est Y », ou l'emploi fréquent de certains adverbes (comme « quietly » en anglais).
Le résultat reste une probabilité, jamais une certitude. Aucun de ces outils ne peut distinguer un texte rédigé par Claude d'un texte que Claude a simplement retravaillé.
Ce que ça change concrètement pour vous, même en solo
Vous ne pouvez plus compter sur un ancien modèle pour échapper durablement au marquage. Les versions de Claude antérieures au 2 août 2026 échappent encore au watermark.
Mais Anthropic dispose d'une période de transition et travaille à les couvrir dans les mois qui suivent. Basculer sur un modèle plus ancien n'est qu'un délai, pas une solution.
Vous ne pouvez pas non plus contourner le dispositif avec un VPN. Le marquage opère au niveau du modèle lui-même.
Il s'applique globalement dès le lancement, sans distinction géographique. Se connecter depuis l'extérieur de l'Union européenne ne change rien au texte produit par Claude.
Vous devez traiter la traduction et la génération pure comme des cas à risque de détection, contrairement à la relecture légère.
Si vous publiez un texte que Claude a traduit intégralement, partez du principe qu'il est identifiable comme contenu IA. Si vous demandez uniquement une correction de grammaire sur votre propre texte, le risque reste beaucoup plus faible.
FAQ
Qu'est-ce que le watermark Claude ?
Le watermark Claude est un signal statistique invisible, intégré dans le choix des mots lors de la génération de texte.
Il ne modifie pas le sens du contenu et n'ajoute aucun caractère caché. Il permet, pour qui détient la clé d'Anthropic, de calculer une probabilité que Claude ait participé à la rédaction d'un texte donné.
Le watermark Claude ralentit-il ou renchérit-il l'usage du modèle ?
Non. Le marquage ne produit aucun token supplémentaire et n'a montré, dans les tests internes d'Anthropic, aucun effet sur la vitesse ou le coût de génération.
La tarification et la latence de Claude restent identiques avec ou sans watermark actif.
Peut-on retirer le watermark d'un texte généré par Claude ?
Une retouche légère ne suffit pas à effacer le signal. Il faut une réécriture profonde, remplaçant la quasi-totalité des mots, pour le fragiliser sérieusement.
Les outils qui promettent de supprimer des caractères invisibles s'attaquent à un problème différent et n'ont aucun effet sur ce mécanisme statistique.
Le watermark Claude peut-il identifier qui a utilisé l'IA ?
Non. Ni le watermark ni sa clé de lecture ne contiennent d'information permettant de retrouver un utilisateur, une organisation ou une conversation précise.
Le mécanisme répond uniquement à la question de la probabilité que Claude soit intervenu dans le texte, pas à celle de son auteur humain.
Le code généré par Claude est-il marqué comme le texte ?
Très peu. Le watermark exploite des choix de mots équivalents, qui n'existent presque pas dans du code où une sortie exacte est requise pour que le programme fonctionne.
Le signal peut apparaître dans les commentaires, mais son effet sur le code lui-même reste négligeable.






