Les textes produits par Claude pourront désormais être identifiés grâce à un marquage invisible. Anthropic déploie cette technologie alors que les nouvelles règles européennes encadrant l’intelligence artificielle entrent progressivement en application.
Claude va laisser une trace invisible dans ses réponses
Un texte généré par Claude pourrait bientôt être reconnaissable par une machine sans qu’aucun indice ne soit visible à l’écran.
Anthropic, l’entreprise américaine à l’origine de Claude, a annoncé l’intégration d’un système de marquage directement dans les textes produits par ses modèles d’intelligence artificielle. Le dispositif concerne les modèles commercialisés par l’entreprise depuis le 2 août 2026.
Contrairement à un avertissement classique, le lecteur ne verra ni logo ni mention indiquant explicitement que le contenu a été créé par une IA. Le signal sera incorporé dans la manière dont le texte est généré et pourra être recherché à l’aide d’outils informatiques.
Cette décision intervient dans un contexte réglementaire particulier. Depuis le 2 août, certaines obligations prévues par l’AI Act européen concernant la transparence des contenus générés par intelligence artificielle sont entrées en application.
Anthropic précise toutefois que son système ne sera pas réservé aux utilisateurs européens. Le marquage doit également être appliqué dans les autres régions où Claude est disponible.
Comment fonctionne le marquage de Claude ?

Anthropic n’a pas encore rendu publique la méthode technique exacte utilisée pour produire son filigrane textuel. L’entreprise doit notamment communiquer ultérieurement davantage d’informations sur les outils capables de le détecter.
Une technique souvent évoquée dans le domaine consiste à modifier légèrement les choix statistiques effectués par un modèle lorsqu’il sélectionne les prochains mots d’une phrase.
Le principe est relativement simple. Parmi plusieurs mots susceptibles de convenir à une phrase, le système peut favoriser discrètement certaines catégories de termes. Sur une quantité suffisamment importante de texte, cette particularité statistique pourrait ensuite être repérée par un logiciel.
Le résultat recherché est un signal invisible pour l’utilisateur, mais suffisamment caractéristique pour permettre à un outil spécialisé de déterminer si un contenu provient potentiellement d’un modèle donné.
Anthropic affirme que ce marquage est conçu pour ne pas modifier le sens des réponses de Claude. L’objectif est également de préserver leur qualité et leur lisibilité.
Le dispositif pourrait même rester présent après certaines opérations courantes, comme un copier-coller dans un traitement de texte.
Un système qui n’est pas infaillible
Malgré cette technologie, le marquage des textes générés par IA ne constitue pas une solution parfaite.
La difficulté apparaît notamment lorsqu’un contenu est fortement modifié après sa génération. Une traduction, une réécriture importante ou la combinaison du texte avec d’autres sources peuvent potentiellement compliquer la détection du signal.
La longueur du contenu représente également un facteur important. Sur quelques lignes seulement, les caractéristiques statistiques nécessaires à une détection fiable peuvent être insuffisantes.
Anthropic reconnaît d’ailleurs que l’absence de signal ne permet pas nécessairement de conclure qu’un texte n’a pas été produit ou modifié avec l’aide d’une intelligence artificielle.
L’inverse est également vrai. La détection d’une marque associée à Claude ne permet pas, à elle seule, d’établir avec une certitude absolue qu’intégralité du contenu provient de l’IA.
Cette nuance pourrait devenir particulièrement importante dans les entreprises, les écoles, les médias et les administrations, où les outils de détection sont susceptibles d’être utilisés pour vérifier l’origine de documents.
Les images utilisent une autre technologie
Anthropic applique une approche différente aux fichiers visuels.
Pour les images aux formats PNG, JPG ou SVG, l’entreprise utilise des métadonnées de provenance protégées par une signature numérique. Cette technologie doit permettre d’indiquer qu’un fichier a été traité par Claude et de repérer certaines modifications.
Le principe existe déjà dans l’industrie photographique. Des fabricants comme Leica, Sony et Nikon utilisent notamment des systèmes liés à la provenance et à l’authenticité des fichiers.
Là encore, le dispositif possède cependant ses propres faiblesses. Une opération aussi simple qu’une capture d’écran peut notamment faire disparaître les informations associées au fichier original.
Anthropic n’est pas le seul acteur concerné
Le choix d’Anthropic s’inscrit dans un mouvement beaucoup plus large du secteur de l’intelligence artificielle.
D’autres grandes entreprises technologiques travaillent également sur des mécanismes permettant d’identifier les contenus créés ou modifiés avec leurs outils.
Microsoft, Meta, OpenAI et Google font partie des entreprises ayant annoncé leur engagement autour du cadre européen destiné à renforcer la transparence de l’IA.
Le secteur musical est également concerné. La plateforme Suno, spécialisée dans la création de musique avec l’intelligence artificielle, a annoncé récemment vouloir mettre en place un système de marquage pour les morceaux générés avec son service.
L’enjeu dépasse donc largement le cas de Claude. Avec la multiplication des textes, images, vidéos et musiques produits par des modèles génératifs, la question de leur provenance devient progressivement centrale.
Le marquage invisible pourrait ainsi devenir l’un des moyens utilisés par les plateformes pour distinguer les contenus synthétiques des créations humaines. Mais son efficacité dépendra largement de la capacité des technologies de détection à résister aux modifications apportées après la génération.
Le déploiement du marquage de Claude marque une nouvelle étape dans la traçabilité des contenus générés par intelligence artificielle. Reste désormais à voir si ces signatures invisibles seront suffisamment robustes pour accompagner durablement les nouvelles règles de transparence.