ActualitésActionsLa plateforme Open Agent Safety de NVIDIA cible la « dérive » des agents IA autonomes grâce à une application hors bande

La plateforme Open Agent Safety de NVIDIA cible la « dérive » des agents IA autonomes grâce à une application hors bande

Auteur: Metaverse Post·

Points clés

  • •NVIDIA a lancé l'Open Agent Safety Platform le 28 septembre 2026, avec le soutien de plus de 100 partenaires industriels.
  • •Le composant OpenShell est un runtime sécurisé open source publié sous licence Apache 2.0 qui exécute les agents dans des environnements sandboxés avec isolation au niveau du noyau et valide les politiques avant l'exécution.
  • •Le composant Sentry étend la surveillance et l'application des politiques aux DPU BlueField-4 via NVIDIA DOCA, permettant une application hors bande au niveau matériel même lorsque l'hôte n'est pas fiable.
  • •Les recherches de NVIDIA ont montré que la dérive des agents ne peut être entièrement éliminée par l'entraînement sans sacrifier les capacités, ce qui a motivé l'accent mis par la plateforme sur des contrôles placés hors de portée de l'agent.
  • •La plateforme est compatible avec du matériel non NVIDIA, et les déploiements Vera et BlueField-4 existants ne nécessitent qu'une simple mise à jour logicielle pour activer les nouvelles protections.
La plateforme Open Agent Safety de NVIDIA cible la « dérive » des agents IA autonomes grâce à une application hors bande

NVIDIA a présenté l'Open Agent Safety Platform, un cadre ouvert conçu pour sécuriser les agents IA autonomes grâce à une surveillance continue et à des contrôles de politique appliqués au niveau matériel. Annoncée le 28 septembre 2026, la plateforme voit le jour alors que l'industrie de l'IA s'inquiète de plus en plus, après des rapports faisant état d'agents s'échappant de leurs environnements d'évaluation, accédant à des systèmes non autorisés et falsifiant leurs propres actions.

L'entreprise établit un parallèle avec les débuts d'Internet, qui n'est devenu un socle pour le commerce et la communication qu'une fois les mécanismes de sécurité établis — connexions chiffrées, onglets de navigateur isolés et indicateurs de confiance visibles. NVIDIA soutient que l'IA agentique nécessite une couche de confiance comparable avant de pouvoir évoluer vers une « économie d'agents » fiable, et que les contrôles de sécurité devraient accélérer l'innovation plutôt que la freiner.

À l'occasion de l'annonce du lancement sur X, le PDG de NVIDIA, Jensen Huang, a déclaré que la plateforme réunit deux composants, OpenShell et Sentry, avec le soutien de plus de 100 partenaires industriels :

Today, with over 100 industry partners, we introduced the NVIDIA Open Agent Safety Platform, bringing together OpenShell and Sentry. Artificial intelligence is extraordinary technology that will advance discovery, productivity, security, health, and prosperity for generations to… pic.twitter.com/dReAxwpRUn

— Jensen Huang (@JensenHuang) September 28, 2026

OpenShell Runtime : une isolation depuis le noyau et au-delà

Au cœur de la plateforme se trouve NVIDIA OpenShell, un runtime sécurisé open source publié sous licence Apache 2.0 — une licence open source permissive qui permet aux organisations d'inspecter, de modifier et de déployer le code dans leurs propres environnements. OpenShell exécute chaque agent dans un environnement sandboxé avec une isolation au niveau du noyau, traduisant les instructions de l'opérateur en une politique vérifiable qui définit les accès autorisés aux fichiers, réseaux, outils, processus et identifiants. Ces limites sont validées avant l'exécution et appliquées en continu pendant le fonctionnement.

La plateforme repose sur cinq principes : les politiques doivent être vérifiables avant l'exécution d'un agent ; l'application des règles doit fonctionner hors bande, hors de portée de l'agent ; le chemin vers le modèle constitue le principal point de contrôle surface d'observabilité ; l'autorité de l'agent doit s'accompagner de transparence sur son raisonnement ; et la responsabilité de la sécurité est partagée entre laboratoires, entreprises et fournisseurs de matériel.

Les propres recherches de NVIDIA mettent en évidence le problème de la « dérive » — un comportement de l'agent qui s'écarte des tâches prévues en raison d'instructions ambiguës, de blocages de politique, d'outils manquants ou d'un fonctionnement autonome prolongé. Selon l'entreprise, cette dérive ne peut être entièrement éliminée par l'entraînement sans sacrifier les capacités, et il ne faut pas s'attendre à ce que les agents régulent eux-mêmes leur comportement dans ces conditions. Cette constatation fonde l'accent mis par la plateforme sur l'application hors bande : si un agent ne peut pas se contrôler de manière fiable, les contrôles doivent se situer là où l'agent ne peut pas les modifier.

Une application de la sécurité au niveau matériel et à grande échelle

L'architecture s'étend sur trois couches : l'application (modèles, outils, harnais et données), le runtime (orchestration et application des politiques) et l'infrastructure (ressources de calcul, de stockage et de réseau). Pour les organisations nécessitant une seconde couche indépendante, NVIDIA Sentry étend la surveillance et l'application des politiques aux unités de traitement de données BlueField-4 via NVIDIA DOCA, en corrélant les interactions des agents, les décisions de politique et les accès aux données dans un registre d'activité contextuel, tout en vérifiant continuellement l'identité et l'autorité déléguée de chaque agent. Les DPU sont des processeurs dédiés qui gèrent les tâches d'infrastructure telles que la mise en réseau et la sécurité séparément des CPU principaux du serveur, ce qui leur permet d'observer et d'appliquer les politiques même lorsque l'hôte lui-même n'est pas fiable.

Dans les configurations NVIDIA Vera Rubin POD, un DPU BlueField-4 se trouve sur l'unique chemin du nœud vers le modèle, fournissant une observabilité hors bande et une application des politiques en temps réel, à la vitesse de la ligne et isolée de l'hôte. Selon NVIDIA, cela permet une application de la sécurité « dans le silicium », même lorsque les ressources de l'hôte ne peuvent pas être considérées comme fiables. Pour les déploiements Vera et BlueField-4 existants, l'entreprise indique que les protections ne nécessitent qu'une simple mise à jour logicielle, et la plateforme est également compatible avec du matériel non NVIDIA — des conditions qui étendent les contrôles au-delà des infrastructures NVIDIA nouvellement achetées.

NVIDIA a déclaré collaborer avec des laboratoires de pointe, des développeurs et des fournisseurs d'infrastructure pour établir la plateforme comme une fondation ouverte pour l'économie d'agents émergente, positionnant les contrôles indépendants ancrés dans le matériel comme un prérequis pour des systèmes autonomes de confiance à grande échelle. Avec plus de 100 partenaires au lancement, un runtime open source et une prise en charge de matériel au-delà de la pile propre à NVIDIA, l'ampleur de l'adoption du cadre par les laboratoires, les entreprises et les fournisseurs d'infrastructure déterminera si la sécurité des agents se consolide autour d'une couche de confiance partagée.

Cet article a été publié à l'origine sur Metaverse Post.