Aller au contenu principal
Intelligence artificielleUSUS

OpenAI déploie le filigrane textGrain dans l'UE sous l'AI Act

OpenAI va intégrer un filigrane invisible aux textes produits par ChatGPT et Codex pour ses utilisateurs de l'Union européenne, en réponse aux exigences de l'AI Act. Le dispositif, baptisé textGrain, reste désactivé par défaut dans l'API et son détecteur n'est ouvert qu'à des chercheurs agréés.

4 min de lectureMis à jour il y a 30 minutes
Illustration de l’article
Crédit image : Sam on Unsplash
Dans cet article
  1. Un déploiement limité à l'Union européenne
  2. Comment fonctionne textGrain
  3. Des performances qui chutent avec les modifications
  4. Un détecteur réservé aux chercheurs agréés
  5. Un calendrier serré pour les fournisseurs

Un déploiement limité à l'Union européenne

OpenAI va ajouter un filigrane invisible aux textes générés par ChatGPT et Codex pour ses utilisateurs de l'Union européenne, selon The Next Web. Le déploiement s'étalera sur plusieurs semaines et concernera les utilisateurs éligibles de toutes les formules, mais uniquement dans cette zone géographique, précise l'entreprise dans une note publiée lundi.

La mesure répond à l'AI Act, qui impose que les contenus produits par une intelligence artificielle soient identifiables par une machine. OpenAI n'a pas fait du filigrane un réglage par défaut à l'échelle mondiale : l'approche régionale doit lui permettre d'observer les usages réels et les retours des utilisateurs.

Comment fonctionne textGrain

Le système, appelé textGrain, insère un signal statistique dissimulé dans le choix des mots du modèle. Un détecteur recherche ensuite ce signal. OpenAI affirme que textGrain a égalé ou dépassé les autres méthodes testées, dont SynthID for text de Google. L'entreprise a publié un rapport technique coécrit avec des chercheurs de l'University of Pennsylvania et de Yale.

Les scores de référence de son modèle Astra ne montrent pas de différence significative lorsque le filigrane est activé, assure OpenAI, qui prévoit aussi de diffuser la technologie en open source.

Des performances qui chutent avec les modifications

OpenAI a également exposé les limites du dispositif. Avec un taux cible de faux positifs de 1 %, son détecteur a repéré le filigrane dans environ 80 % de passages de 200 tokens sur des thèmes comme la psychologie. Sur des passages de 400 tokens, le taux atteint environ 95 %.

Remplacer 10 % des mots par des synonymes fait tomber la détection d'environ 92 % à 66 %. En substituant un quart des mots, elle chute à 17 %. La détection est nettement plus faible en mathématiques, où le choix des mots est moins libre, indique l'entreprise.

Un détecteur réservé aux chercheurs agréés

Le filigrane n'identifie pas l'utilisateur, ne mesure pas la contribution humaine, n'établit pas de propriété et ne vérifie pas l'exactitude d'un texte, prévient OpenAI. L'absence de filigrane ne prouve pas non plus qu'un humain a rédigé le contenu : le texte peut être trop court, avoir été modifié ou traduit, ou provenir des outils d'une autre société.

« These limitations contribute to our decision to provide initial detector access only to approved researchers and expert organizations, who can help us evaluate reliability and responsible uses », écrit OpenAI.

Les candidatures sont ouvertes depuis lundi et l'accès sera accordé au cas par cas, conformément au Code of Practice européen, selon l'entreprise. Le détecteur signale la présence d'un filigrane OpenAI sans identifier l'utilisateur ni révéler les requêtes. OpenAI élargira l'accès lorsque les résultats pourront être interprétés de manière responsable. Ses outils de vérification des images et de l'audio restent, eux, publics.

Un calendrier serré pour les fournisseurs

L'article 50 de l'AI Act oblige les fournisseurs d'IA générative à rendre leurs sorties textuelles lisibles par une machine. Les fournisseurs déjà présents sur le marché ont jusqu'au 2 décembre pour s'y conformer, rapporte Engadget.

Anthropic a commencé à filigraner les textes de Claude à l'échelle mondiale en août, avec certaines exemptions. Des outils permettant de retirer ces filigranes sont depuis apparus. Google DeepMind a également appliqué SynthID à des protéines conçues par IA.

Maillage