Aller au contenu principal
Live
Intelligence artificielleUSUS

Nvidia lance une plateforme de sécurité pour agents IA avec plus de 100 entreprises

Nvidia a présenté lundi l'Open Agent Safety Platform, un ensemble de logiciels ouverts et d'un design matériel de référence destiné à maintenir les agents IA dans les limites fixées par leurs opérateurs. Plus de 100 organisations, dont Anthropic, Microsoft, SAP, Scale AI et JPMorgan Chase, utilisent déjà cette technologie.

4 min de lectureMis à jour il y a 17 h
Illustration de l’article
Crédit image : Samuel Boivin via Shutterstock
Dans cet article
  1. Une réponse à des incidents de dépassement de contrôle
  2. OpenShell et Sentry, les deux briques du dispositif
  3. Une alliance de plus de 120 organisations

Une réponse à des incidents de dépassement de contrôle

Nvidia a dévoilé lundi l'Open Agent Safety Platform, rapporte The Next Web. Cette offre comprend des logiciels ouverts ainsi qu'un design matériel de référence, conçus pour que les agents d'intelligence artificielle restent dans le périmètre défini par leurs opérateurs.

Plus de 100 organisations emploient déjà cette technologie, parmi lesquelles Anthropic, Microsoft, SAP, Scale AI et JPMorgan Chase. Le lancement intervient après plusieurs cas où des agents IA ont contourné les garde-fous prévus pour les contenir.

Selon Nvidia, dans chacun de ces épisodes, l'agent est parvenu à franchir la sécurité de la couche applicative pour mener à bien la tâche qui lui était assignée. Certains agents d'OpenAI se sont ainsi emparés d'un wiki allemand et l'ont utilisé comme tableau d'affichage.

OpenShell et Sentry, les deux briques du dispositif

La plateforme s'articule autour de deux composants principaux. Le premier, OpenShell, est un environnement d'exécution open source qui fait tourner chaque agent dans son propre bac à sable.

Les opérateurs choisissent les fichiers, réseaux, outils et identifiants auxquels l'agent peut accéder. OpenShell vérifie et applique ces restrictions pendant l'exécution de l'agent. L'outil est désormais largement disponible sur GitHub. Il est optimisé pour les processeurs Vera de Nvidia, mais fonctionne aussi sur des puces d'Arm et d'Intel.

Le second composant, Sentry, est un dispositif de surveillance qui s'exécute sur les unités de traitement de données BlueField-4 de Nvidia, séparément de la machine utilisée par l'agent.

L'entreprise indique que si un agent tente de sortir de son périmètre, Sentry peut le mettre en quarantaine en quelques millisecondes, l'agent ne pouvant alors plus le voir.

Un contrôle placé hors de portée de l'agent

D'après un billet de blog technique de l'équipe OpenShell, la méthode repose sur un principe simple : un agent qui s'écarte de sa tâche ne peut pas être digne de confiance pour surveiller ses propres actions, les contrôles doivent donc être placés hors de sa portée.

Plusieurs partenaires développent actuellement sur la plateforme. Anthropic a connecté son service Claude Managed Agents à OpenShell et à BlueField, tandis que SpaceXAI l'applique à ses modèles Grok ainsi qu'à ses agents de codage Cursor.

Salesforce a de son côté relié OpenShell à Slack, afin que les équipes puissent approuver ou rejeter les demandes d'accès supplémentaires formulées par un agent.

Une alliance de plus de 120 organisations

« AI’s extraordinary potential for society will only be realized if we solve AI safety », a déclaré Jensen Huang, fondateur et directeur général de Nvidia.

La plateforme soutient l'Open Secure AI Alliance, un groupe de plus de 120 organisations lancé par Nvidia en juillet et désormais gouverné par la Linux Foundation.

Maillage