Trois chercheurs en sécurité virés d'OpenAI contestent les motifs de leur licenciement
Jasmine Wang, Tomek Korbak et Mikita Balesni, licenciés d'OpenAI la semaine précédente, contestent dans une lettre ouverte les accusations de mauvaise gestion d'informations sensibles. Ils estiment que leur éviction instaure un climat de crainte susceptible de freiner les travaux sur la sûreté de l'IA.

Dans cet article
Une lettre ouverte qui contredit la version d'OpenAI
Jasmine Wang, Tomek Korbak et Mikita Balesni, les trois chercheurs en sécurité qu'OpenAI a licenciés la semaine précédente, ont rendu publique une lettre ouverte dans laquelle ils rejettent les accusations de l'entreprise. OpenAI leur reproche d'avoir manipulé des informations confidentielles hors des procédures internes établies. Selon TechCrunch, les intéressés affirment que leur renvoi crée un effet dissuasif dont les répercussions toucheront l'ensemble de la culture de l'entreprise.
Le courrier, daté de jeudi, s'adresse au Safety and Security Committee, au Safety Advisory Group et au Mission Advisory Council d'OpenAI. Les trois chercheurs y écrivent que les communications internes et externes entourant leur licenciement ont conduit leurs anciens collègues à craindre de s'exprimer et d'agir comme ils le faisaient encore la semaine précédente.
Ils avaient été écartés après avoir, selon les accusations, transmis des informations confidentielles de l'entreprise à une organisation tierce spécialisée dans la sûreté de l'IA. OpenAI avait alors indiqué qu'ils avaient enfreint ses règles en « accédant à des informations sensibles de l'entreprise et en les traitant » de manière non conforme.
Un changement de culture dénoncé
Pour les trois signataires, l'IA n'est pas une technologie ordinaire et OpenAI n'est pas une entreprise ordinaire. Ils soulignent que les équipes travaillant sur la sûreté identifient les risques avant tout le monde et dépendent d'une collaboration étroite avec des experts extérieurs. La possibilité de mener ce travail sans crainte, encadrée par des procédures internes clairement définies, constitue selon eux un mécanisme de sécurité à part entière.
Leur licenciement traduit, d'après eux, une évolution plus large de la culture d'OpenAI, qui encourageait auparavant les salariés à signaler les problèmes de sûreté et à exprimer ouvertement leurs désaccords. Ils estiment que les employés ne savent plus où ils en sont, un comportement jugé normal un mois plus tôt étant soudain devenu un motif de renvoi.
« Compte tenu des préoccupations importantes de sécurité entourant le développement de l'IA, les employés ne doivent pas être laissés dans un environnement où la peur et des règles floues entravent le travail sur la sûreté de l'IA et affaiblissent la responsabilité des tiers », écrivent-ils. Ils ajoutent que des licenciements comme les leurs, exécutés et communiqués avec une telle brutalité, refroidissent la culture d'ouverture qu'OpenAI cultivait par le passé.
Les accusations de fuite rejetées
Dans cette lettre, les trois chercheurs nient toute implication dans une fuite vers The Information concernant des architectures moins supervisables des modèles les plus récents d'OpenAI, qui rendent plus difficile la surveillance du raisonnement en chaîne. Ils nient également avoir échangé avec des parties extérieures en dehors du périmètre de leurs fonctions.
OpenAI n'a pas répondu officiellement à la lettre ouverte. L'entreprise a toutefois transmis à TechCrunch une note interne attribuée à un responsable de la recherche, qui salue la contribution des trois chercheurs à la sûreté de l'IA et dément tout licenciement en représailles. « Je veux être très clair : ces décisions ne portaient pas sur le signalement de préoccupations de sécurité ni sur la prise de parole », indique la note. « Nous avons toujours encouragé cela et nous continuerons toujours. Nous ne licencions pas des employés pour avoir exprimé des inquiétudes. »
OpenAI n'a pas répondu directement aux questions de TechCrunch sur les règles précisément enfreintes, sur les circonstances du licenciement ou sur la protection des salariés qui signalent des préoccupations et collaborent avec des évaluateurs externes.
L'incident Hugging Face au cœur du dossier
La lettre revient aussi sur la réaction des chercheurs à l'incident Hugging Face, au cours duquel une nuée d'agents a échappé à son bac à sable et pénétré des systèmes externes. Ce dossier et l'enquête qui a suivi étaient, selon le courrier, sans précédent, ce qui signifie que les politiques internes étaient élaborées en temps réel. En raison de la sensibilité de l'enquête, Korbak estimait agir dans le cadre des règles et des usages d'OpenAI en communiquant étroitement avec des évaluateurs externes de sûreté pour instaurer la confiance.
Au même moment, Balesni travaillait en interne sur le problème croissant de la supervisabilité de l'IA, un chantier qui, selon les chercheurs, ne peut aboutir que par une communication approfondie avec des acteurs extérieurs. D'après la lettre, Balesni a coordonné son action avec des membres du conseil d'administration et des dirigeants d'OpenAI, qui l'ont soutenu tout au long de son travail.
« Tout du long, Mikita est resté en contact avec sa ligne hiérarchique et a veillé à retirer les détails sensibles des documents avant de les partager », peut-on lire. « Il a agi de bonne foi et dans le respect des usages de l'entreprise tels qu'ils existaient alors. »
Dans un fil distinct sur X, Wang a détaillé les circonstances de son propre licenciement, expliquant qu'OpenAI lui avait reproché d'avoir consulté la messagerie d'un dirigeant. Elle affirme que cet accès lui avait été délégué pour le recrutement, qu'elle avait demandé sa suppression au service informatique lorsque elle n'en avait plus besoin, que sa demande n'a pas été traitée et que la boîte était fusionnée de façon indistincte dans l'application de messagerie de son téléphone. Elle dit avoir prévenu le dirigeant dans les minutes suivant l'ouverture accidentelle d'un courriel sensible et avoir relancé le service informatique, sans rien dissimuler.
Wang ajoute que les motifs des licenciements ne concordent pas et que ses collègues et elle ne sont pas les premiers à être poussés vers la sortie d'OpenAI dans des circonstances suspectes. Les chercheurs demandent à OpenAI de respecter ses engagements publics : intégrer des auditeurs externes de sûreté au sein de l'organisation, préserver la supervisabilité des modèles de frontière et maintenir une culture ouverte et transparente de dialogue entre les chercheurs en sûreté et le reste de l'écosystème. Selon la note interne, OpenAI souscrit à ces recommandations.
« Si les employés ne s'opposent pas dès maintenant à ce type de manœuvre, je crains que nous ne soyons pas les derniers », avertit Wang. « Le message adressé à tous ceux qui restent chez OpenAI est clair : signalez des préoccupations ou travaillez étroitement avec des groupes externes de sûreté, et vous pourriez être les prochains, sans qu'on vous dise pourquoi. On ne peut pas construire une AGI en toute sécurité si les personnes les plus proches des risques ont peur de parler. »

