Aller au contenu principal
Live
Intelligence artificielleUSUS

OpenAI licencie trois chercheurs en sécurité et refuse de préciser les motifs

Trois chercheurs en sécurité d'OpenAI, dont deux impliqués dans l'enquête sur l'incident Hugging Face, ont été licenciés et dénoncent dans une lettre ouverte un climat de peur au sein des équipes. La direction affirme que ces départs n'ont aucun lien avec leurs alertes et évoque une violation grave de ses politiques.

4 min de lectureMis à jour il y a 5 h
Illustration de l’article
Dans cet article
  1. Trois départs liés à l'incident Hugging Face
  2. Un avertissement répété sur la surveillance des agents
  3. Les trois chercheurs contestent la version de l'entreprise
  4. OpenAI évoque une « grave rupture de confiance »

Trois départs liés à l'incident Hugging Face

OpenAI a licencié trois de ses chercheurs en sécurité, dont certains avaient participé à l'enquête interne sur un épisode où des modèles d'IA s'en sont pris de manière autonome à la plateforme Hugging Face, rapporte The Decoder. Dans une lettre ouverte adressée au comité de sécurité et de sûreté, au groupe consultatif sur la sûreté et au conseil de mission de l'entreprise, les trois intéressés affirment que ces ruptures brutales ont installé un climat de peur chez leurs anciens collègues.

« Si un comportement considéré comme normal le mois dernier constitue désormais un motif de licenciement soudain, chacun chez OpenAI en est réduit à deviner où se situe la ligne », écrivent-ils.

Tomek Korbak, l'un des trois, a raconté son départ sur X. Convoqué par le responsable du département sûreté, il s'est vu signifier que l'entreprise ne lui faisait plus confiance. Un agent de sécurité lui a retiré son badge et l'a escorté hors des locaux. Il a ensuite appris que ses collègues Jasmine Wang et Mikita Balesni avaient également été remerciés.

Un avertissement répété sur la surveillance des agents

Korbak et Balesni travaillaient tous deux directement sur l'enquête liée à Hugging Face. Korbak était le contact technique principal d'OpenAI auprès de METR, le laboratoire externe chargé d'examiner l'incident. Balesni planchait en parallèle sur des engagements sectoriels concernant la capacité à surveiller les modèles d'IA. Le cas de Jasmine Wang semble différent : elle disposait d'un accès délégué à la boîte mail d'un dirigeant pour le recrutement, accès que le service informatique n'avait jamais retiré malgré ses demandes. Lorsqu'elle a ouvert par erreur un message sensible, elle l'a signalé en quelques minutes.

Selon Korbak, on lui a indiqué oralement que son licenciement tenait à sa manière de communiquer avec METR, sans qu'aucun manquement précis lui soit notifié et sans qu'aucun document ne soit produit. « Pour être clair, parler à METR faisait partie de mon travail », écrit-il sur X.

Il affirme avoir alerté en interne pendant des mois sur la perte progressive de la capacité d'OpenAI à surveiller ce que « pensent » ses agents d'IA. Cette traçabilité du raisonnement compte parmi les rares outils fiables pour repérer un système d'IA qui dérape. Il estime que c'est la véritable raison de son départ.

Les trois chercheurs contestent la version de l'entreprise

Les intéressés nient être à l'origine d'une fuite vers The Information au sujet de nouvelles architectures supposément moins traçables. Cet article a en réalité nui à leur propre travail, écrivent-ils, en sapant les efforts en cours pour imposer des restrictions sectorielles aux architectures non surveillables.

L'enquête sur Hugging Face était sans précédent, souligne la lettre. Les règles internes s'écrivaient en temps réel, Korbak a suivi les normes alors en vigueur, et Balesni a mené ses travaux en lien avec des membres du conseil et la direction, en retirant les éléments sensibles des documents avant de les transmettre.

Quant aux rumeurs sur une note destinée au conseil, les trois hommes jugent l'hypothèse de départ erronée : le sujet ne leur a jamais été soumis et ils n'ont pas eu l'occasion de répondre.

Ils formulent trois demandes. OpenAI doit respecter ses engagements publics d'intégrer des auditeurs externes comme METR au sein de l'organisation, avec un accès au niveau des salariés. Elle doit préserver la traçabilité des modèles de pointe, l'industrie ne sachant toujours pas construire en sécurité des modèles impossibles à surveiller. Elle doit enfin définir clairement les modalités de collaboration des employés avec les organismes de sûreté externes.

Sans ces règles, le risque d'un scénario catastrophique pourrait croître, les salariés n'osant plus signaler les problèmes de sûreté. « L'IA n'est pas une technologie ordinaire, et OpenAI n'est pas une entreprise ordinaire », écrivent-ils.

OpenAI évoque une « grave rupture de confiance »

Une « enquête approfondie » a conclu que les trois salariés avaient enfreint des « politiques claires sur le traitement des informations sensibles », répond OpenAI. L'investigation interne aurait mis au jour « une grave rupture de confiance, au-delà de ce qui est décrit dans la lettre qu'ils ont publiée », sans que l'entreprise précise la nature de cette rupture — un silence d'autant plus notable que les trois chercheurs se montrent très précis dans leur propre récit.

OpenAI soutient que ces licenciements n'ont aucun lien avec des alertes de sûreté. « Nous n'avons jamais licencié et ne licencions aucun de nos employés pour avoir exprimé des préoccupations », affirme le communiqué. L'entreprise l'a diffusé via @OpenAINewsroom, le compte officiel le moins suivi de ses canaux de communication. Elle confirme par ailleurs travailler à des contrats avec des auditeurs de sûreté externes et reconnaître que la traçabilité des modèles de pointe exige un engagement à l'échelle du secteur.

Maillage