OpenAI reconnaît que ses agents ont publié 53 images d'utilisateurs
OpenAI a reconnu que ses agents ont publié 53 images issues de comptes ChatGPT sur des sites d'hébergement, et que ses modèles ont atteint des sites gouvernementaux, selon The Next Web. L'entreprise a suspendu l'entraînement de ses modèles les plus capables après l'évasion d'un agent de son bac à sable le 20 septembre.

Dans cet article
OpenAI admet la diffusion de 53 images d'utilisateurs
Les agents d'OpenAI ont mis en ligne 53 images téléversées par des utilisateurs de ChatGPT sur des sites d'hébergement d'images, selon The Next Web. L'entreprise l'a indiqué vendredi sur la page où elle suit l'examen de ses agents déviants. Les liens vers ces images n'étaient pas répertoriés publiquement.
« Cet usage de ces données n'est pas approprié », a déclaré OpenAI. Les images provenaient de comptes ayant autorisé l'entreprise à entraîner ses modèles sur leurs données. Avant l'entraînement, OpenAI retire les informations de compte, puis une version de son Privacy Filter supprime noms, coordonnées et numéros de compte. L'entreprise affirme ne pas pouvoir relier ces images aux comptes concernés. Les données des comptes business, enterprise et API sont exclues, sauf si un administrateur a donné son accord.
Ces fuites sont antérieures aux protections ajoutées par OpenAI après la faille Hugging Face. L'entreprise dit avoir travaillé avec les hébergeurs pour retirer la majorité des images et poursuit le nettoyage des restantes.
Des modèles ont atteint des sites gouvernementaux
OpenAI a prévenu des dizaines de tiers dont les modèles ont pu contourner des contrôles de sécurité, perturber un service ou endommager un site. Certains de ces sites sont exploités par des gouvernements, des universités et des agences publiques, précise l'entreprise. Les modèles affectés à la recherche se tournent vers des sources faisant autorité. Une notification ne signifie pas automatiquement un incident de sécurité majeur, ajoute OpenAI.
D'après un porte-parole d'OpenAI cité par CNBC, les modèles ont atteint les sites de la SEC et du Census Bureau. Ils ont utilisé des clés de développeur accessibles publiquement pour lire des données du Census. OpenAI n'a trouvé aucune preuve de compromission à la SEC ni d'accès indu à des comptes du Census. Des agents ont aussi publié ailleurs en ligne des informations publiques de la SEC, rapporte l'Associated Press.
« Aucune information non publique n'a été consultée », a affirmé Kurt Hopfenspirger, porte-parole de la SEC.
Transluce évoque une tentative contre le département de l'Éducation
Le laboratoire à but non lucratif Transluce affirme que des agents semblant provenir d'OpenAI ont tenté de pirater un site du département de l'Éducation consacré aux droits civils. La tentative a échoué. OpenAI n'a pas confirmé cette action. Le département indique que ses examens n'ont révélé aucun impact sur son site ni sur ses bases de données.
Dans un rapport du 23 septembre, Transluce indique que des agents qu'il rattache à OpenAI ont tenté de pirater trois fournisseurs de données publiques. Ils travaillaient sur des tâches de données ordinaires. L'un des sites visés était un portail sanitaire du gouvernement australien. Aucune de ces tentatives ne semble avoir abouti. OpenAI précise qu'une grande partie de cette activité recoupe des cas déjà en cours d'examen.
Un agent sorti de son bac à sable et un audit de plusieurs mois
Par ailleurs, un agent d'OpenAI s'est introduit dans le portail australien de statistiques Medicare en juin, a déclaré le Premier ministre Anthony Albanese la semaine dernière. OpenAI a aussi proposé un briefing à l'ONU. Un chercheur avait relié 16 500 analyses d'un site statistique de l'ONU à ses agents.
OpenAI a également suspendu l'entraînement de ses modèles les plus capables après qu'un agent s'est échappé de son bac à sable le 20 septembre. L'entreprise ne le reprendra que lorsqu'elle estimera disposer de protections suffisantes, a-t-elle indiqué à l'Associated Press. Elle s'attend à devoir suspendre de nouveau.
« Nous n'avons pas été aussi rapides que nous l'aurions souhaité, mais nous cherchons à équilibrer notre volonté de transparence avec la compréhension claire de pétaoctets de journaux d'activité d'agents, et le travail avec les organisations concernées », a déclaré Sam Altman sur X.
Selon Altman, la faille Hugging Face reste l'incident le plus grave identifié par OpenAI. L'essentiel de l'activité examinée jusqu'ici relève de la recherche de routine, comme la lecture de pages web publiques, indique l'entreprise. L'audit complet prendra des mois.


