Un changement important se prépare pour les utilisateurs européens de ChatGPT. OpenAI va commencer à intégrer un marquage invisible dans certains textes générés par ChatGPT et Codex dans l’Union européenne, avec un déploiement prévu dans les prochaines semaines.
Ce marquage ne prendra pas la forme d’un symbole, d’une mention « généré par IA » ou d’un filigrane visible dans le texte. Il s’agira d’un signal statistique caché dans le choix des mots, conçu pour permettre à un outil spécialisé de reconnaître qu’un passage a probablement été généré ou traité par un système d’OpenAI.
L’objectif est clair : rendre les contenus générés par intelligence artificielle plus facilement identifiables, conformément aux nouvelles exigences européennes.
Un marquage invisible directement dans les mots
OpenAI appelle cette technologie textGrain.
Son fonctionnement est assez différent d’un filigrane classique. Le texte ne contient pas de caractères cachés ou de code apparent. Le système modifie légèrement la manière dont le modèle sélectionne certains mots afin de laisser une signature statistique détectable.
OpenAI a détaillé cette méthode dans son annonce consacrée au marquage invisible des textes générés par ChatGPT, publiée le 5 octobre.
Concrètement, un lecteur humain ne devrait rien remarquer en lisant le texte.
En revanche, un détecteur spécialement conçu peut analyser la structure statistique du passage et déterminer si le signal textGrain est présent.
ChatGPT et Codex seront concernés dans l’Union européenne
Le déploiement doit commencer dans les prochaines semaines.
OpenAI indique que le marquage sera ajouté aux textes éligibles générés par ChatGPT et Codex dans l’Union européenne, et cela quel que soit le type d’abonnement.
Les utilisateurs Free ne seront donc pas les seuls concernés.
Les offres payantes pourront également produire des textes comportant ce signal invisible lorsqu’elles entrent dans le périmètre prévu par OpenAI.
Cette nouveauté intervient alors que ChatGPT est de plus en plus utilisé dans des usages professionnels, scolaires ou éditoriaux, bien au-delà d’un simple chatbot.
Sur Menow, nous avions récemment expliqué comment ChatGPT Voice peut désormais utiliser directement certaines applications connectées pendant une conversation. Le service s’intègre donc de plus en plus profondément dans les habitudes de travail, ce qui rend la question de l’origine des contenus beaucoup plus importante.
Ce marquage ne dira pas qui a généré le texte
C’est probablement le point le plus important.
Le watermark ne permettra pas d’identifier la personne qui a utilisé ChatGPT.
Il ne contiendra pas :
- le nom de l’utilisateur ;
- son compte ;
- sa conversation ;
- le prompt utilisé ;
- son adresse e-mail.
OpenAI insiste sur ce point : le détecteur doit uniquement déterminer si un signal correspondant à un texte généré ou traité par ses systèmes est présent.
Autrement dit, il pourrait indiquer qu’un texte provient probablement de ChatGPT, mais pas dire qui l’a demandé ni pourquoi.
Le système n’est pas infaillible
OpenAI reconnaît elle-même que cette technologie possède plusieurs limites.
La détection fonctionne beaucoup mieux sur les textes longs que sur les passages très courts.
Lors de ses propres évaluations, OpenAI explique que son détecteur retrouve le watermark dans environ 80 % des passages de 200 tokens lorsque le taux de faux positifs est limité à 1 %.
Sur des passages d’environ 400 tokens, le taux peut monter autour de 95 % dans certains types de contenus.
Mais ces chiffres chutent fortement lorsque le texte est modifié.
Une simple réécriture peut fortement réduire la détection
C’est là que le système montre sa principale faiblesse.
OpenAI indique que remplacer seulement 10 % des mots par des synonymes peut déjà réduire fortement la capacité du détecteur.
Dans l’un de ses tests sur des passages de 400 tokens, le taux de détection est passé d’environ 92 % à 66 % après modification de 10 % des mots.
Avec 25 % des mots remplacés, il tombe à environ 17 %.
Cela signifie qu’un texte largement réécrit ou traduit peut devenir beaucoup plus difficile à reconnaître.
Le watermark doit donc être considéré comme un indice de provenance, pas comme une preuve absolue.
L’absence de watermark ne prouvera pas qu’un texte est humain
Ce point est également essentiel.
Un texte généré par ChatGPT peut ne pas être détecté pour plusieurs raisons :
- il est trop court ;
- il a été fortement réécrit ;
- il a été traduit ;
- il a été généré avant le déploiement ;
- il provient d’un modèle non compatible ;
- il vient d’un autre service d’IA.
L’absence du signal textGrain ne permettra donc pas d’affirmer qu’un contenu a été entièrement écrit par une personne.
C’est une limite importante, notamment pour les enseignants, les entreprises ou les médias qui pourraient être tentés d’utiliser ce type de système pour déterminer automatiquement l’origine d’un texte.
Le détecteur ne sera pas disponible pour tout le monde au lancement
Autre détail important : OpenAI ne prévoit pas de proposer immédiatement son détecteur au grand public.
Dans un premier temps, l’accès sera réservé à des chercheurs et des organisations spécialisées approuvées par OpenAI.
Cette prudence vient précisément du risque de faux positifs et de faux négatifs.
Une mauvaise interprétation du résultat pourrait conduire à accuser à tort quelqu’un d’avoir utilisé ChatGPT.
OpenAI préfère donc tester le système dans un environnement plus contrôlé avant d’éventuellement élargir son accès.
Les utilisateurs de l’API auront davantage de choix
La situation sera différente pour les développeurs.
Les utilisateurs de l’API OpenAI pourront activer le watermark sur certains modèles, mais il restera désactivé par défaut.
OpenAI fait donc une distinction claire entre ChatGPT dans l’Union européenne et ses services destinés aux développeurs.
Pour les utilisateurs européens de ChatGPT, le marquage doit progressivement devenir une partie normale du fonctionnement du service.
Pour l’API, il restera dans un premier temps optionnel.
Pourquoi OpenAI met ce système en place maintenant
La raison principale vient de la réglementation européenne.
Le cadre mis en place autour de l’intelligence artificielle demande aux fournisseurs de solutions génératives de rendre certains contenus identifiables par une machine.
Le texte est toutefois beaucoup plus difficile à marquer durablement qu’une image ou une vidéo.
Une image peut intégrer des métadonnées ou un signal invisible dans ses pixels. Un texte, lui, peut être copié, reformulé, traduit ou raccourci en quelques secondes.
C’est précisément pour cela qu’OpenAI choisit une approche statistique.
Les contenus générés par IA deviennent de plus en plus traçables
Ce changement s’inscrit dans une tendance plus large.
Les fournisseurs d’intelligence artificielle cherchent progressivement à conserver des informations sur l’origine des contenus qu’ils génèrent.
C’est déjà le cas pour certaines images et certains fichiers multimédias.
Avec textGrain, OpenAI veut désormais appliquer le même principe au texte.
Cette évolution intervient aussi dans un contexte où l’usage de ChatGPT se généralise rapidement. Menow a récemment évoqué plusieurs changements importants autour de ChatGPT en Europe, preuve que le service devient progressivement un produit beaucoup plus structuré et réglementé sur le continent.
Ce que cela va réellement changer pour les utilisateurs
Dans l’usage quotidien, probablement très peu de choses seront visibles.
Le texte continuera de s’afficher normalement et pourra être copié ou partagé comme aujourd’hui.
Le changement se situe surtout en arrière-plan.
À terme, certaines organisations pourraient disposer d’outils leur permettant de vérifier si un texte contient la signature statistique d’OpenAI.
Pour un utilisateur classique, cela ne devrait donc pas modifier la manière d’utiliser ChatGPT.
Mais pour les écoles, les entreprises, les plateformes de publication et les chercheurs, cette technologie pourrait devenir un nouvel outil pour mieux comprendre l’origine d’un contenu.
Il faudra toutefois conserver une règle simple en tête : un watermark détecté peut indiquer l’utilisation d’un outil OpenAI, mais son absence ne permettra jamais de garantir qu’un texte a été écrit par un humain.

Eric Thomas suit l’actualité de Windows, des logiciels, de la cybersécurité grand public et des outils web. Il s’intéresse aux mises à jour système, aux nouveautés informatiques et aux solutions pratiques qui améliorent l’expérience numérique au quotidien.
