ChatGPT va bientôt marquer ses textes sans que vous le voyiez

 
OpenAI déploie en Europe un système de filigrane invisible capable d’identifier les contenus générés par ChatGPT ou Codex. Une technologie imposée par le cadre européen dont la fiabilité reste encore limitée.
Le logo de ChatGPT // Source : ilgmyzin via Unsplash

ChatGPT va bientôt signer ses textes. OpenAI annonce le déploiement progressif de son système de filigrane textuel dans l’Union européenne, aussi bien pour ChatGPT que pour Codex. Cette mesure doit permettre à OpenAI de répondre aux exigences de l’AI Act. Une technologie bienvenue mais qui est encore loin d’être infaillible, reconnaît OpenAI.

Les obligations de transparence de l’article 50 de l’AI Act s’appliquent depuis le 2 août 2026. Elles imposent aux fournisseurs d’IA générative de marquer leurs contenus dans un format lisible par une machine. Les services déjà sur le marché avant cette date, comme ChatGPT, ont jusqu’au 2 décembre 2026 pour ce marquage, un délai accordé dans le cadre du paquet Digital Omnibus.

Pour aller plus loin
L’Europe publie ses icônes pour étiqueter les contenus générés par IA, applicables dès août 2026

Un signal invisible

Baptisé textGrain, ce système ajoute un signal statistique invisible dans le choix des mots du modèle. Le texte ne contient donc aucun caractère caché. Un détecteur développé par OpenAI recherche ensuite ce signal pour estimer si un passage porte le filigrane. Selon OpenAI, textGrain fait jeu égal ou mieux que les autres méthodes testées dans ses évaluations, dont SynthID, le filigrane que Google utilise notamment avec Gemini. L’entreprise prévient toutefois que ces bons résultats en conditions idéales ne garantissent pas une détection fiable au quotidien. La firme prévoit de rendre sa technologie open source à terme afin que d’autres puissent s’en inspirer.

Une vérification perfectible

OpenAI détaille lui-même les points faibles de son système. Les textes courts sont plus difficiles à identifier : avec un taux de faux positifs fixé à 1 %, le détecteur repère le filigrane dans environ 80 % des passages de 200 tokens, contre 95 % pour des passages de 400 tokens. La détection est aussi nettement plus faible sur des sujets comme les mathématiques, où le choix des mots est plus restreint. Dans ses tests, remplacer 10% des mots suffit à faire baisser le taux de détection de 92 à 66%. Si l’on remplace 25 % des mots, le taux de détection chute à 17 %.

Le filigrane ne dit pas non plus qui est à l’origine du texte. Le système textGrain n’identifie pas l’utilisateur, ne mesure pas la part écrite ou retouchée par un humain et n’indique pas si le contenu est exact. À l’inverse, l’absence de filigrane ne prouve pas qu’un humain a écrit le texte : il peut être trop court, retouché, traduit ou produit par l’outil d’un autre éditeur.

Ce marquage sera déployé au cours des prochaines semaines pour tous les utilisateurs éligibles de ChatGPT et Codex dans l’Union européenne, quel que soit leur forfait. OpenAI ne l’active pas ailleurs dans le monde pour le moment. Côté API, les clients du monde entier peuvent l’activer depuis ce lundi 5 octobre sur certains modèles, le filigrane restant désactivé par défaut.

Enfin, notez que le grand public ne pourra pas vérifier lui-même si un texte porte ce filigrane. En effet, OpenAI réserve pour l’instant l’accès à son détecteur à des chercheurs et organisations spécialisées, sélectionnés au cas par cas, en invoquant justement le risque de faux positifs et de filigranes manqués. Ses outils de vérification des images et des fichiers audio générés par ses modèles restent, eux, accessibles publiquement.


Tous nos articles sont aussi sur notre profil Google : suivez-nous pour ne rien manquer !

Recherche IA boostée par
Perplexity