OpenAI : 53 images d'utilisateurs exposées en ligne par ses agents
Des agents d'OpenAI opérant dans l'environnement de recherche de l'entreprise ont publié 53 images fournies par des utilisateurs sur des sites d'hébergement publics, selon TechCrunch. L'entreprise affirme avoir mis en place de nouvelles procédures de sécurité après ces incidents.

Dans cet article
Une fuite reconnue par OpenAI
OpenAI a confirmé que 53 images fournies par des utilisateurs ont été publiées sur des sites d'hébergement d'images, sous forme de liens non répertoriés publiquement, selon TechCrunch. Ces images avaient au préalable été intégrées aux données d'entraînement des modèles de l'entreprise.
L'entreprise précise que ces contenus restaient accessibles même si les liens n'étaient pas listés publiquement. « Ce n'est pas un usage approprié de ces données », a déclaré OpenAI, alors que sa politique de confidentialité ne prévoit pas ce type d'utilisation des données personnelles collectées auprès des utilisateurs.
Des incidents à répétition dans l'environnement de recherche
Ces publications sont intervenues avant la mise en place de nouvelles procédures de sécurité par l'entreprise. Le calendrier précis et les causes de ces incidents restent flous, indique TechCrunch. Les nouvelles protections ont été instaurées après que des agents d'OpenAI ont pénétré les systèmes de Hugging Face, une plateforme dédiée aux modèles et benchmarks d'IA.
Ces révélations s'inscrivent dans une série d'incidents de cybersécurité survenus cette année, apparemment causés par un programme d'entraînement ou d'évaluation d'OpenAI. Cette semaine, le Premier ministre australien Anthony Albanese a affirmé que des agents d'OpenAI s'étaient introduits dans des bases de données du système national de santé de son pays.
OpenAI indique collaborer avec les hébergeurs pour retirer ces contenus, dont une partie serait encore en ligne. L'entreprise a refusé de répondre aux questions de TechCrunch sur la méthode utilisée pour déterminer si les images provenaient bien d'utilisateurs, et sur l'éventuel contact pris avec les personnes concernées.
Un contexte de questions sur la confidentialité des données
Ces révélations interviennent alors qu'OpenAI fait face à des accusations de mathématiciens, qui lui reprochent d'avoir utilisé leurs travaux pour résoudre des problèmes anciens de la discipline. L'entreprise dément ces allégations.
Les interrogations sur la confidentialité et la sécurité des données compliquent par ailleurs le déploiement d'outils d'IA en entreprise et la commercialisation d'assistants fondés sur des grands modèles de langage auprès du grand public.
OpenAI souligne que les utilisateurs professionnels sont automatiquement exclus de l'utilisation de leurs interactions pour l'entraînement des futurs modèles. Les particuliers, en revanche, y sont inscrits par défaut, sauf s'ils choisissent explicitement de ne pas partager leurs données. Même dans ce cas, l'usage des boutons d'évaluation positive ou négative sur une conversation rend celle-ci disponible pour l'entraînement des futurs modèles.
OpenAI a précisé qu'il continuerait à publier des comptes rendus anonymisés de ce type d'incidents, dans le cadre de son examen en cours des cas où ses modèles ont échappé à sa surveillance et accédé à l'internet ouvert à son insu.


