OpenAI commence à déployer une nouvelle technologie destinée à identifier plus facilement l’origine de ses textes générés par IA. Baptisée textGrain, cette technologie ajoute un filigrane invisible et lisible par machine aux textes produits par certains modèles de ChatGPT et Codex.
Le déploiement commence exclusivement dans l’Union européenne. OpenAI explique vouloir utiliser cette première phase régionale pour observer le fonctionnement du système en conditions réelles et recueillir les retours des utilisateurs avant d’envisager une éventuelle extension.
Un filigrane invisible dans les textes générés
Contrairement à un marquage visuel, textGrain ne modifie pas l’apparence du texte pour l’utilisateur. Le filigrane est conçu pour être invisible et détectable automatiquement, afin de fournir une indication sur la provenance potentielle du contenu.
OpenAI affirme que ses résultats de tests montrent que textGrain a obtenu des performances comparables ou supérieures à d’autres méthodes de watermarking textuel, notamment SynthID de Google DeepMind.
Anthropic avait également annoncé en août une technologie similaire, notamment dans le contexte des exigences européennes concernant la provenance des contenus générés par IA.
ChatGPT et Codex concernés dans l’UE
OpenAI prévoit de déployer textGrain progressivement au cours des prochaines semaines auprès des utilisateurs éligibles de ChatGPT et Codex dans l’Union européenne. Le dispositif doit être disponible sur tous les forfaits concernés, mais uniquement dans l’UE au lancement. OpenAI précise qu’il ne s’agit donc pas d’un nouveau réglage activé par défaut à l’échelle mondiale.
Cette approche régionale doit permettre à l’entreprise d’observer les usages réels du système avant de décider d’une éventuelle généralisation.
Les performances seraient peu affectées
OpenAI affirme également avoir comparé des textes générés avec et sans filigrane à travers plusieurs benchmarks. Selon l’entreprise, les résultats montrent des performances similaires entre les deux versions. L’objectif est donc de rendre le marquage suffisamment robuste sans modifier significativement la qualité du texte produit par les modèles.
Mais OpenAI insiste sur une limite essentielle : textGrain ne garantit pas une détection fiable dans tous les cas.

Un filigrane textuel peut notamment être altéré par certaines transformations du contenu. Il ne faut donc pas considérer sa présence ou son absence comme une preuve absolue de l’origine d’un texte.
Ce que le filigrane ne permet pas de savoir
OpenAI prend également soin de préciser ce que textGrain ne peut pas démontrer. La technologie ne permet pas de vérifier si le contenu généré est exact ou factuellement correct. Elle ne permet pas non plus de déterminer qui possède les droits sur le texte, quelle quantité de travail humain a été apportée ou de prouver qu’un texte a été entièrement rédigé par une personne.
Autrement dit, un filigrane peut fournir un indice de provenance, mais il ne constitue pas un certificat d’authenticité ou de qualité.
Cette distinction sera particulièrement importante dans les usages scolaires, professionnels ou éditoriaux, où l’origine d’un texte et la contribution humaine peuvent être des questions très différentes.
Les clients API pourront choisir
OpenAI ne limite pas cette technologie aux utilisateurs de ChatGPT et Codex. À partir d’aujourd’hui, les clients de l’API dans le monde entier pourront activer volontairement le filigranage pour les modèles concernés. Cette possibilité doit permettre aux entreprises d’intégrer le marquage à leurs propres obligations de transparence ou aux expériences qu’elles proposent à leurs utilisateurs.
OpenAI indique également travailler avec des partenaires cloud afin de rendre cette technologie disponible dans les prochaines semaines pour les sorties de modèles OpenAI utilisées via leurs services.
Un détecteur réservé aux chercheurs
OpenAI va également ouvrir l’accès à son outil de détection, mais pas au grand public dans un premier temps. Les chercheurs et organisations spécialisées pourront déposer une demande à partir d’aujourd’hui. L’accès sera initialement accordé au cas par cas, afin de contribuer à l’évaluation et à l’amélioration des technologies de provenance.
Le détecteur indiquera simplement s’il identifie un filigrane OpenAI. Il ne révélera pas l’identité de l’utilisateur et ne donnera pas accès à ses prompts ou à ses conversations.
OpenAI justifie cette restriction par les risques de faux positifs et de détections manquées. Rendre immédiatement l’outil accessible au public pourrait donc conduire à des interprétations erronées de ses résultats.
L’Europe devient le laboratoire du watermarking IA
Le choix de commencer par l’Union européenne n’est pas anodin. OpenAI inscrit textGrain dans le contexte des nouvelles exigences européennes concernant la transparence et la provenance des contenus générés par IA.
Le déploiement d’un filigrane invisible rapproche ainsi ChatGPT et Codex d’une logique dans laquelle les contenus produits par les modèles peuvent être accompagnés d’informations permettant d’en déterminer plus facilement l’origine. Mais, OpenAI garde une approche prudente. textGrain doit être considéré comme un outil de provenance, pas comme un détecteur infaillible de textes générés par IA.
La véritable question sera désormais de savoir comment cette technologie résistera aux modifications, traductions, réécritures et autres transformations qu’un texte peut subir après sa génération.