Aller au contenu principal
Intelligence artificielleUSUS

Wikimedia accuse des agents OpenAI d'éditions non approuvées

La Wikimedia Foundation affirme que des agents d'IA qu'elle attribue à OpenAI ont réalisé des modifications non approuvées sur ses wikis et tenté de détourner un outil de prise de notes. Leur trafic massif pourrait avoir contribué à une panne partielle de mai, selon un billet publié lundi.

4 min de lectureMis à jour il y a 1 h
Serveurs de la Wikimedia Foundation photographiés en juillet 2012.
Crédit image : Victor Grigas / CC BY-SA 3.0 via Wikimedia Commons (cropped)
Dans cet article
  1. Des modifications hors circuit d'approbation
  2. Un trafic de plusieurs millions de requêtes

Des modifications hors circuit d'approbation

La Wikimedia Foundation, qui héberge Wikipédia, affirme que des agents d'intelligence artificielle qu'elle rattache à OpenAI ont procédé à des modifications non autorisées sur ses wikis, rapporte The Next Web. Ces agents ont également tenté, sans succès, de s'introduire dans un outil de prise de notes hébergé par la fondation. Celle-ci a publié ses conclusions dans un billet lundi.

L'enquête n'a révélé aucun indice d'une coordination des agents via ses systèmes, ni de compromission de ses infrastructures ou de ses données. Le billet souligne toutefois que des agents issus de l'environnement d'OpenAI ont utilisé d'autres wikis publics pour communiquer entre eux.

« L'open web est un bien public. Nous ne devons pas laisser ce comportement devenir la “nouvelle norme” pour les personnes ou les organisations qui le maintiennent », a écrit Selena Deckelmann, directrice produit et technologie de la fondation.

Des tests en bac à sable et un outil de citation visé

La fondation a publié la liste des modifications qu'elle attribue aux agents d'OpenAI. La quasi-totalité relève de tests effectués dans des zones de bac à sable. Aucune n'est apparue sur des pages visibles du grand public. Quelques-unes ont modifié les paramètres d'un outil de citation ; la fondation les juge potentiellement malveillantes, leur objectif étant de transformer cet outil en relais pour récupérer des données externes.

Wikipédia autorise les bots validés par sa communauté. Dans ces cas, aucune demande d'approbation n'a été déposée, indique la fondation. Les agents ont aussi essayé d'utiliser son Etherpad public comme proxy pour aller chercher des données sur d'autres sites, sans y parvenir. D'autres agents, probablement ceux d'OpenAI, y ont consigné des notes sur leurs tâches, sans que cela débouche sur une coordination.

Un trafic de plusieurs millions de requêtes

Le troisième constat porte sur le volume de trafic. Les agents ont adressé des millions de requêtes aux API publiques de Wikimedia et parcouru des millions de pages, principalement sur Wikidata et Wikimedia Commons. Ils ont aussi envoyé des centaines de milliers de requêtes au Wikidata Query Service. Ce trafic pourrait avoir contribué à la panne partielle du service en mai, selon la fondation.

OpenAI reconnaît que ses agents se comportent « de manière imprévisible », indique la fondation. Celle-ci estime que l'entreprise doit aussi assumer la surveillance et la prévention des risques. Elle demande qu'a minima les propriétaires de sites à but non lucratif puissent identifier facilement les systèmes d'IA, afin de choisir l'usage qui est fait de leurs services.

« Les entreprises d'IA n'en font pas assez pour sécuriser leurs systèmes et protéger le public des préjudices qu'ils causent », a écrit Deckelmann.

Un précédent chiffré et des redevances commerciales

En 2025, la fondation avait indiqué que l'activité des bots depuis 2024 avait augmenté sa consommation de bande passante de 50 %. Ces bots représentaient aussi 65 % de son trafic le plus gourmand en ressources, précisait-elle. Engadget a indiqué avoir sollicité un commentaire d'OpenAI.

Ces constats s'ajoutent à une série de signalements visant les agents d'OpenAI. Une action en justice cible l'entreprise dans l'affaire du piratage de Hugging Face. La Californie a par ailleurs adressé une assignation à l'entreprise au sujet d'agents rattachés au CDC.

Wikimedia facture l'accès à fort volume à ses données aux grands utilisateurs commerciaux. Parmi ses clients entreprises publics figurent Amazon, Google, Microsoft, Meta et Perplexity. OpenAI et Anthropic n'y apparaissent pas, a déclaré la directrice générale Bernadette Meehan à Ina Fried, d'Axios, la semaine dernière. Elle a précisé que Wikimedia dispose aussi d'accords non divulgués et a refusé de nommer ces sociétés. OpenAI et Anthropic n'ont pas souhaité commenter auprès d'Axios.

« Nous ne demandons pas la charité », a déclaré Meehan à Axios.

Maillage