OpenAI va filigraner les textes de ChatGPT dans l'UE
OpenAI déploie un filigrane invisible sur les textes produits par ChatGPT et Codex dans l'Union européenne, pour se conformer aux règles de transparence de l'AI Act entrées en vigueur le 2 août. La méthode, baptisée textGrain, résiste mal aux modifications selon les tests de l'entreprise.

Dans cet article
Un filigrane invisible pour se conformer à l'AI Act
OpenAI a annoncé lundi dans un billet de blog l'ajout d'un filigrane invisible aux textes générés par ChatGPT et Codex au sein de l'Union européenne. Cette mesure répond aux obligations de transparence de l'AI Act européen, applicables depuis le 2 août, qui imposent aux entreprises d'IA de signaler les contenus générés de manière identifiable par d'autres systèmes, rapporte TechCrunch.
Le déploiement s'étalera sur les prochaines semaines pour les utilisateurs éligibles de ChatGPT et Codex, tous abonnements confondus, mais uniquement dans l'UE. Les développeurs qui passent par l'API d'OpenAI, partout dans le monde, peuvent l'activer dès aujourd'hui sur certains modèles ; l'option est désactivée par défaut. L'entreprise précise qu'elle ne fait pas du filigrane textuel un réglage mondial par défaut au lancement.
Comment fonctionne textGrain
Le procédé ne repose pas sur un symbole visible : il influence discrètement le choix des mots du modèle, créant un motif imperceptible pour un lecteur mais détectable par un outil dédié. Comme il est inscrit dans le texte lui-même, il se maintient lors d'un copier-coller. OpenAI assure que ce filigrane n'identifie pas l'utilisateur et qu'il n'a constaté aucune modification significative des performances de ses modèles lorsqu'il est activé.
En parallèle, OpenAI a publié un rapport technique sur sa méthode, appelée textGrain, coécrit avec des chercheurs de l'University of Pennsylvania et de Yale. Le document détaille l'usage d'une clé secrète pour trier les prédictions de mots suivants afin de terminer une phrase. En cumulant des centaines de ces ajustements, le détecteur peut repérer un contenu généré par IA à partir du seul texte et de la clé.
Les limites de la détection
Un filigrane peut-il être effacé par simple édition ? Les tests d'OpenAI suggèrent que oui. Dans l'un d'eux, remplacer 10 % des mots par des synonymes fait chuter la détection d'environ 92 % à 66 %. L'entreprise indique également que les passages courts, les réponses mathématiques et les textes traduits sont plus difficiles à identifier.
« Ces limites contribuent à notre décision de réserver l'accès initial au détecteur à des chercheurs et organisations expertes approuvés, qui peuvent nous aider à évaluer la fiabilité et les usages responsables », a déclaré l'entreprise.
OpenAI met aussi en garde : l'absence de filigrane « ne prouve pas qu'un texte est d'origine humaine ». Le contenu peut être trop court, trop retravaillé, ou provenir de l'IA d'une autre société.
« [Les filigranes] peuvent indiquer qu'un système OpenAI a généré ou traité une partie d'un passage, mais pas quelle part de jugement humain, d'édition ou de créativité y a été investie », selon l'entreprise.
Un contexte concurrentiel et réglementaire
Cette annonce intervient deux mois après qu'Anthropic a indiqué qu'il filigranerait les textes produits par Claude, une mesure appliquée à l'échelle mondiale. Cette décision avait suscité des critiques de certains utilisateurs de Claude, qui estimaient avoir fourni « les instructions, le contexte, les décisions » tandis que Claude n'était que « l'outil ».
OpenAI avait déjà développé un filigrane textuel par le passé, mais avait renoncé à le déployer, en partie par crainte que les utilisateurs ne se tournent vers des concurrents sans filigrane, selon le Wall Street Journal en 2024.
Anthropic, Google, Meta, Microsoft et OpenAI figurent parmi les entreprises qui se sont engagées à respecter le code de bonnes pratiques de l'UE sur les contenus générés par IA.


