Aller au contenu principal
Live
Intelligence artificielleUSUS

OpenAI accuse des utilisateurs liés à Moonshot AI de distillation adverse

OpenAI affirme que des personnes liées à Moonshot AI, le développeur chinois de Kimi, ont mené une campagne coordonnée pour extraire le raisonnement caché de ses modèles. L'entreprise dit avoir démantelé l'opération fin juillet et renforcé ses contrôles.

4 min de lectureMis à jour il y a 2 h
Illustration de l’article
Crédit image : Bangla press via Shutterstock.com
Dans cet article
  1. Une campagne détectée début juillet
  2. Un « core cluster » attribué à Moonshot
  3. Ni intrusion ni accès aux conversations stockées
  4. Des accusations contestées

Une campagne détectée début juillet

Des personnes liées à Moonshot AI, le développeur chinois de Kimi, seraient à l'origine d'une campagne coordonnée visant à extraire le raisonnement caché des modèles d'OpenAI, selon The Next Web. L'entreprise américaine a exposé ses conclusions dans une publication mercredi.

L'activité a démarré le 1er juillet à faible volume. Elle a connu un pic les 24 et 25 juillet, avec 16 000 requêtes émises par plus de 4 000 utilisateurs. OpenAI a ensuite identifié des activités connexes impliquant plus de 15 000 utilisateurs. La société indique avoir totalement mis fin à la campagne le 28 juillet.

Un « core cluster » attribué à Moonshot

OpenAI précise ne pas pouvoir relier chaque opérateur à un acteur unique, mais attribue « un core cluster » à des personnes associées à Moonshot.

« Cette activité est cohérente avec la distillation adverse : l'usage systématique et non autorisé des sorties ou du raisonnement d'un modèle pour aider à entraîner, reproduire ou améliorer un autre modèle », a écrit OpenAI.

Selon l'entreprise, les opérateurs ont copié le raisonnement chiffré d'une conversation, puis ont demandé à un modèle, dans une autre conversation, de le déchiffrer et de le transcrire. OpenAI masque le raisonnement suivi par ses modèles avant qu'ils ne répondent.

Ni intrusion ni accès aux conversations stockées

OpenAI affirme que les opérateurs n'ont pas cassé le chiffrement, ni accédé à une base de données, ni atteint des conversations d'utilisateurs stockées. L'entreprise a depuis banni des comptes, renforcé les vérifications à l'inscription et ajouté des protections pour le raisonnement caché.

Elle a également partagé ses conclusions avec d'autres laboratoires d'IA via le Frontier Model Forum et par des canaux gouvernementaux. « Notre préoccupation porte sur la violation de nos conditions d'utilisation, pas sur les modèles ouverts ni sur la distillation légitime », a déclaré Caroline Zier, qui dirige les initiatives stratégiques de politique de sécurité nationale chez OpenAI, à Bloomberg.

Des accusations contestées

Il s'agit de la première fois qu'OpenAI accuse Moonshot, rapporte Bloomberg. Anthropic avait formulé une accusation similaire contre l'entreprise dans un rapport le mois dernier, selon Bloomberg.

Des agences américaines ont porté la même charge. Un avis publié ce mois-ci nommait six entreprises chinoises et les modèles américains visés par chacune. La Chine a rejeté cet avis, le qualifiant d'accusations sans fondement.

Ces affirmations ne font pas l'unanimité. David Sacks, ancien responsable de l'IA de Trump, a qualifié ces rapports de poussée visant à faire interdire par les États-Unis les modèles ouverts concurrents, selon Bloomberg.

Moonshot fait aussi l'objet d'un examen dans son pays. Les régulateurs chinois enquêtent sur DeepSeek et Moonshot, a rapporté The Information ce mois-ci.

Maillage