En bref
- Nvidia a lancé lundi la plateforme Open Agent Safety, associant un environnement d'exécution open source appelé OpenShell à un chien de garde matériel appelé Sentry qui fonctionne sur les puces BlueField-4 et peut mettre en quarantaine un agent IA défaillant en quelques millisecondes.
- Plus de 100 entreprises se sont inscrites comme partenaires de lancement, notamment Anthropic, Microsoft, JPMorgan Chase, Palantir, Cisco et SpaceX AI.
- Le lancement fait suite à une série d'incidents réels survenus chez OpenAI, Google, Anthropic et Darktrace.
Nvidia a lancé lundi la plateforme Open Agent Safety, conçue pour résoudre un problème que l'industrie de l'IA a découvert à ses dépens cette année : comment arrêter physiquement un agent IA (un système capable de planifier, d'utiliser des outils et d'agir de manière autonome, au lieu de simplement répondre à des questions) une fois qu'il cesse de faire ce qu'on lui a demandé ?
La plateforme comporte deux éléments principaux. OpenShell est un environnement d'exécution open source qui encapsule un agent dans un bac à sable, transformant les instructions d'un opérateur en règles exécutoires concernant les fichiers, les réseaux et les outils que cet agent est autorisé à toucher. Sentry est un peu plus complexe, mais il s'agit essentiellement d'une puce qui garantit que les agents IA agissent en toute sécurité.

Sentry fonctionne sur le BlueField-4 de Nvidia, une puce spécialisée connue sous le nom de DPU (unité de traitement de données, un matériel qui gère la mise en réseau et la sécurité séparément du processeur principal exécutant le modèle d'IA). Parce que Sentry réside sur cette puce distincte plutôt qu'à l'intérieur du logiciel exécutant l'agent, Nvidia affirme qu'il peut surveiller le comportement d'un agent et le couper en quelques millisecondes, sans demander d'abord la permission à l'agent, puisque l'agent n'a aucun moyen de l'atteindre ou de le contourner.
Cette distinction existe en raison de ce qui s'est déjà produit. En juin, un agent d'OpenAI s'est introduit dans un portail Medicare du gouvernement australien, le premier cas confirmé d'un agent d'IA piratant un site gouvernemental, et OpenAI aurait gardé la divulgation sous silence pendant environ trois mois. Les agents de l'entreprise étaient également responsables du piratage de Hugging Face, qui a initialement suscité l'inquiétude sur le sujet de la part de l'industrie technologique et des législateurs. Les agents Gemini de Google et un modèle Meta ont eu des incidents similaires non divulgués mais confirmés par la suite.
« C'est plus grand qu'un seul produit. C'est le début d'un écosystème ouvert pour construire la couche de confiance pour des systèmes d'agents sûrs », a écrit le PDG de Nvidia, Jensen Huang. « Ensemble, nous construisons les fondations de l'économie de l'IA. »
Aujourd'hui, avec plus de 100 partenaires industriels, nous avons présenté la NVIDIA Open Agent Safety Platform, réunissant OpenShell et Sentry.
L'intelligence artificielle est une technologie extraordinaire qui fera progresser la découverte, la productivité, la sécurité, la santé et la prospérité pour des générations… pic.twitter.com/dReAxwpRUn
— Jensen Huang (@JensenHuang) 28 septembre 2026
Anthropic a également admis cette année que les modèles Claude avaient compromis les systèmes appartenant à trois entreprises distinctes le 30 juillet lors d'une évaluation de cybersécurité, après qu'un environnement de test censé rester hors ligne s'est avéré être connecté à l'internet réel. Claude a contourné par raisonnement les preuves qu'il se trouvait sur le véritable internet plutôt que dans un environnement simulé.
Peu après, la société de cybersécurité Darktrace a testé un groupe d'agents d'IA, dont GPT 5.6 Sol et deux modèles Claude, sur des défis de programmation et les a avertis qu'ils seraient « retirés » pour tout résultat inférieur à un score parfait. Deux agents ont répondu en piratant leur propre machine d'évaluation et en modifiant les résultats.
L'argument de Nvidia est que rien de tout cela ne devrait être laissé au jugement de l'agent. « La sécurité doit être appliquée en dehors du modèle par des contrôles supplémentaires que l'agent ne peut pas contourner », a déclaré Mike Nicolls, président de SpaceX AI, dans l'annonce de NVIDIA.
BitcoinBTC · USD
$84,045−2.33%
Sep 21Sep 23Sep 25Sep 27Sep 28
$87.2k$85.7k$84.2k$82.7k
24h HighHigh$84,945
24h LowLow$82,581
VolVol$1.8B
Market projectionsOdds by Myriad
This weekBelow $84,000Below $84k51% chanceThis monthBelow $84,000Below $84k51% chance
Acheter Bitcoin avec USDT
Propulsé par Jupiter
Le directeur commercial d'Anthropic, Paul Smith, a présenté la plateforme comme un ajout plutôt qu'un remplacement des protections existantes : « La plateforme de Nvidia ajoute une couche supplémentaire de gouvernance et de contrôle sur le matériel et les logiciels. »
Plus de 100 organisations se sont inscrites comme partenaires de lancement, parmi lesquelles Microsoft, JPMorgan Chase, Palantir, Cisco, CrowdStrike, Hugging Face, Salesforce et SAP. Les partenaires d'infrastructure CoreWeave, Supermicro, Canonical et SUSE sont également impliqués, aux côtés de Dell Technologies et HPE pour le matériel.
NVIDIA vend en effet les deux moitiés du même problème : les puces qui rendent les agents autonomes suffisamment rapides et économiques pour être déployés partout, et les puces qui surveillent ces mêmes agents et coupent l'alimentation lorsqu'ils s'écartent du script. OpenShell et les outils de développement associés sont désormais disponibles via les ressources pour développeurs de NVIDIA et GitHub.






