ActualitéIT, Data & IATechnologies

Anthropic commence à intégrer des filigranes invisibles dans tous les textes de Claude

Claude intègre désormais des marqueurs invisibles dans les textes générés par ses principaux modèles. Anthropic s’appuie sur une signature statistique dissimulée dans le choix des mots, notamment pour répondre aux règles de transparence de l’AI Act européen. Et une simple correction de quelques phrases ne suffirait pas forcément à la faire disparaître.

Claude glisse une signature invisible dans le choix des mots

Le filigrane de Claude ne ressemble pas à un logo, à une mention « généré par IA » ou à une suite de caractères cachés dans le document. Pour le lecteur, rien ne change à l’écran.

Anthropic utilise une méthode reposant sur le principe de SynthID-Text, développé par Google DeepMind. Le système agit directement pendant la génération du contenu en orientant certains choix de vocabulaire.

Lorsqu’un modèle peut employer plusieurs mots sans changer le sens général d’une phrase, il peut privilégier l’un d’entre eux selon un schéma statistique prédéfini.

Un choix totalement banal en apparence. Mais répété sur suffisamment de texte, il finit par former une empreinte.

Par exemple, le modèle pourrait préférer un mot comme « couvert » à « gris » lorsque les deux conviennent au contexte. Ces différences sont imperceptibles à la lecture, mais un outil disposant de la bonne clé peut rechercher le motif laissé par ces choix successifs.

Quelques retouches ne suffiraient pas à effacer le filigrane

Modifier légèrement un texte généré par Claude ne ferait pas nécessairement disparaître sa signature invisible.

Anthropic explique que le marquage peut résister à des corrections limitées tant qu’une part suffisamment importante du texte d’origine est conservée. Changer quelques mots, supprimer une phrase ou reformuler certains passages pourrait donc ne pas suffire.

A lire :  Tokens IA : les méthodes les plus efficaces pour réduire les coûts

Pour réellement supprimer cette empreinte, il faudrait aller beaucoup plus loin. Selon l’entreprise, une réécriture humaine complète serait nécessaire pour faire disparaître efficacement le motif statistique.

C’est un point important pour les utilisateurs qui se contentent habituellement de retoucher des contenus produits par une IA avant de les publier.

Anthropic prépare un outil capable de détecter les textes de Claude

Anthropic prévoit également de proposer un outil de détection permettant d’analyser un texte et de vérifier s’il porte la signature de ses modèles.

L’objectif est simple : rendre l’origine d’un contenu généré par intelligence artificielle plus facile à identifier, sans afficher de marque visible pour le lecteur.

Cette méthode doit notamment aider Anthropic à se conformer aux exigences de transparence imposées par l’Union européenne concernant certains contenus produits par IA.

Le code généré par Claude est beaucoup moins concerné

Le système fonctionne nettement moins bien avec du code informatique. Les langages de programmation laissent peu de liberté dans le choix des termes et de la syntaxe : une modification mal placée peut suffire à rendre un programme inutilisable.

Claude ne peut donc pas remplacer librement un élément par un autre uniquement pour renforcer une signature statistique.

Les zones plus souples, comme les commentaires dans le code, pourraient accueillir ce type de marquage. Mais le programme lui-même resterait en grande partie à l’écart du dispositif.

Les textes de Claude deviennent plus faciles à identifier

Avec ce système, Anthropic veut rendre les contenus issus de Claude reconnaissables sans modifier leur apparence.

Pour les utilisateurs, la différence est invisible. Pour un outil de détection, elle peut l’être beaucoup moins.

A lire :  GPT-5 fait trembler même son créateur : Sam Altman avoue sa peur face à une IA « trop puissante »

Le changement concerne surtout les textes classiques générés par la plateforme : articles, réponses, descriptions ou autres contenus rédigés avec Claude peuvent désormais contenir une empreinte statistique discrète, conçue pour survivre à de petites modifications.

Samuel Le Goff suit l’actualité des smartphones, des systèmes d’exploitation mobiles et de l’intelligence artificielle depuis plus de 14 ans. Il couvre notamment Samsung, Xiaomi, Apple, Android, iOS et les grandes tendances du numérique.

Samuel

Samuel Le Goff suit l’actualité des smartphones, des systèmes d’exploitation mobiles et de l’intelligence artificielle depuis plus de 14 ans. Il couvre notamment Samsung, Xiaomi, Apple, Android, iOS et les grandes tendances du numérique.

Voir tous les articles

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *