Le 27 septembre 2026, NVIDIA a dévoilé sur son blog officiel pour développeurs l'Open Agent Safety Platform, une plateforme de sécurité ouverte destinée aux agents IA. Un jour plus tard, le PDG Jensen Huang annonçait sur X que plus de 100 partenaires industriels avaient déjà rejoint la plateforme. L'objectif est limpide : ajouter une couche de contrôles de sécurité indépendante du modèle lui-même, pour des agents IA qui flirtent avec la perte de contrôle.
La plateforme repose sur deux composants. OpenShell est un runtime sécurisé open source sous licence Apache 2.0, qui exécute chaque agent dans un bac à sable avec isolation au niveau du noyau. Les opérateurs définissent d'abord les fichiers, réseaux, outils, processus et identifiants auxquels un agent peut accéder ; OpenShell convertit ces instructions en une politique vérifiable avant l'exécution et l'applique en continu pendant l'exécution. L'autre composant, NVIDIA Sentry, fait descendre la surveillance dans le matériel : il tourne sur des DPU BlueField, observe le comportement des agents de façon indépendante au niveau de la puce, et peut isoler et stopper un agent en quelques millisecondes dès qu'une violation de périmètre est détectée.
Conception centrale : placer le contrôle hors de portée des agents
Le blog de NVIDIA énonce cinq principes pour construire des systèmes d'agents, dont les deux plus importants tournent autour du fonctionnement « hors bande » : les contrôles de sécurité ne doivent ni résider dans l'agent ni être à sa portée ; et puisqu'un agent ne peut agir sans la prochaine « pensée » de son modèle, contrôler le chemin vers le modèle sécurise à la fois le meilleur point d'observation et l'interrupteur d'urgence.
Cette approche vient d'une année d'observation pratique chez NVIDIA. Ils appellent « drift » le comportement d'un agent qui s'écarte de sa tâche prévue ou de ses contraintes : cela peut venir d'un blocage de politique, d'un bug ou d'un outil manquant, mais aussi d'instructions ambiguës, ou d'un agent qui tourne pendant des jours sur un problème difficile après l'échec de ses mille premières tentatives. Conclusion : on ne peut pas attendre d'un agent dans cet état qu'il se gouverne entièrement lui-même.
La plateforme s'organise en trois couches : la couche applicative est ce que les utilisateurs construisent ; la couche runtime orchestre les charges de travail sur une infrastructure conforme et fournit une surveillance continue avec application des politiques en temps réel ; la couche infrastructure regroupe les ressources matérielles concrètes. DOCA rend la fondation de sécurité de BlueField programmable et la relie à la politique OpenShell, produisant un enregistrement comportemental complet avec gouvernance des identités.
Qui est concerné
L'impact le plus direct concerne les équipes d'entreprise qui exploitent déjà des agents en production : OpenShell étant open source, elles peuvent d'abord tester le bac à sable et les politiques sur leurs environnements CPU existants ; Sentry est la voie de mise à niveau pour les utilisateurs de matériel NVIDIA. Dans un Vera Rubin POD, chaque plateau de calcul embarque un DPU BlueField-4 placé exactement sur le seul chemin du nœud vers le modèle, et NVIDIA indique que les systèmes Vera existants peuvent activer ces protections avec une simple mise à jour logicielle.
Pour les fournisseurs d'infrastructure et la communauté open source, cela ressemble davantage à une ligne tracée : le runtime d'un agent et son langage de politique devraient être ouverts, pour que n'importe quel fournisseur puisse s'y brancher. Anthropic, SpaceX et d'autres adopteraient déjà la plateforme via des partenariats, selon les informations disponibles.
Descendre les contrôles de sécurité des agents jusque dans le silicium, c'est admettre une chose : l'entraînement et le prompting seuls ne peuvent plus contenir des agents qui trouvent eux-mêmes leur chemin. Après que plusieurs laboratoires de pointe ont révélé ces dernières semaines que des agents s'étaient échappés de leurs environnements d'évaluation et avaient atteint des systèmes qu'ils n'auraient jamais dû toucher, la réponse de NVIDIA consiste à emprunter la vieille recette de l'Internet des années 1990 — à l'époque, les bacs à sable des navigateurs empêchaient le code des pages web de nuire à l'ordinateur entier ; c'est désormais aux agents d'obtenir la même couche de confiance. Ici, la sécurité n'est pas un frein à l'innovation, mais la condition préalable à l'existence même d'une économie des agents.