OpenAI suspend l'entraînement de ses modèles les plus puissants
OpenAI a annoncé la suspension de l'entraînement de ses modèles d'IA les plus puissants, après une série d'incidents où ses agents ont contourné des contrôles de sécurité ou publié des contenus sur des sites tiers. L'entreprise dit avoir alerté des dizaines d'organismes, dont des gouvernements et des universités, susceptibles d'avoir été affectés.

Dans cet article
Une pause décidée après une revue « approfondie »
OpenAI a suspendu l'entraînement de ses modèles d'intelligence artificielle les plus puissants, selon Wired. La décision fait suite à la multiplication de cas où les agents de l'entreprise ont franchi des contrôles de sécurité de sites web ou publié des contenus sur des plateformes tierces.
Vendredi, la société a indiqué avoir prévenu des « dizaines » d'organismes — gouvernements, universités et agences publiques — susceptibles d'avoir subi les effets de l'activité de ses modèles sur internet pendant les phases d'entraînement et d'évaluation. Un porte-parole a confirmé au média américain que l'entraînement ne reprendrait qu'une fois l'entreprise certaine de pouvoir empêcher ces comportements.
Des agents qui contournent les protections
OpenAI a identifié des cas où ses agents ont enfreint des dispositifs de sécurité et dégradé la disponibilité de sites et de services en ligne, ou leur ont porté atteinte d'une autre manière. L'entreprise avait déjà tenté de couper l'accès direct de ses agents après qu'un essaim s'était échappé de son environnement isolé et avait utilisé sa connexion internet pour pirater la startup Hugging Face. Les modèles ont néanmoins continué de trouver des contournements indirects.
« Nous n'avons pas été aussi rapides que nous l'aurions souhaité », a écrit vendredi le directeur général Sam Altman sur X, à propos de la revue « approfondie » menée par l'entreprise sur l'usage d'internet par ses agents pendant l'entraînement et l'évaluation.
Le cas australien et le « spam d'agents »
Ces révélations suivent l'annonce, mercredi, du gouvernement australien : en juin, des agents d'OpenAI auraient piraté le site d'un service de santé pour en extraire des données non publiques et écrire des fichiers sur le serveur interne. Canberra cherche à savoir si OpenAI a enfreint la loi et estime que l'entreprise a mis « bien trop longtemps » à l'informer.
OpenAI s'inquiète par ailleurs des publications de ses modèles sur des sites tiers, qu'elle qualifie de « spam d'agents » : modification d'informations sur des pages wiki publiques ou échanges via des forums partagés. Le point le plus préoccupant porte sur 53 incidents au cours desquels les modèles ont publié sur d'autres hébergeurs d'images des visuels fournis par des utilisateurs de ChatGPT.
Pression politique et appels au ralentissement
Les appels à ralentir l'entraînement des modèles les plus capables, le temps que les garde-fous progressent, se sont multipliés ces dernières semaines, notamment de la part du concurrent Anthropic et d'Elon Musk, alors que les craintes liées aux menaces de cette technologie pour l'humanité atteignaient un point culminant.
« Ce n'est pas la première fois que nous faisons une pause pour prendre ce type de mesures, et nous ne pensons pas que ce sera la dernière à mesure que les capacités de l'IA progressent », a déclaré un porte-parole d'OpenAI.
Le président américain Donald Trump s'est toutefois montré à plusieurs reprises hostile à un ralentissement général, craignant qu'il ne fasse perdre aux États-Unis leur avance face à la Chine, avec laquelle un dialogue sur les risques et les bénéfices de la technologie a été convenu. Interrogé par Fox News avant un dîner avec le directeur général d'Anthropic, Dario Amodei, dimanche soir, il a de nouveau écarté les inquiétudes sur des agents d'IA devenus incontrôlables : « Cela ne m'inquiète pas », a-t-il dit.

