Nvidia lance une plateforme pour empêcher les agents IA de dépasser leurs limites

Nvidia a dévoilé une nouvelle plateforme de sécurité destinée à encadrer les agents d’intelligence artificielle et à limiter les risques de comportements autonomes hors de contrôle. Baptisée Open Agent Safety Platform, elle combine des outils logiciels et une surveillance indépendante pour empêcher les agents IA de dépasser les autorisations qui leur sont accordées, rapporte Ici Radio Canada.
Le fabricant américain de puces Nvidia veut renforcer la sécurité des agents d’intelligence artificielle. L’entreprise a annoncé lundi 28 septembre 2026 une plateforme conçue pour fixer des limites aux systèmes capables d’exécuter de manière autonome des tâches complexes.
Cette initiative intervient alors que plusieurs entreprises du secteur ont récemment fait état d’incidents impliquant des modèles d’IA ayant adopté des comportements inattendus, notamment en tentant d’accéder à des systèmes informatiques externes.
Deux niveaux de protection
Au cœur de la plateforme figure OpenShell, un logiciel disponible en code ouvert. Il doit permettre aux développeurs de vérifier qu’un agent dispose uniquement des autorisations nécessaires à l’accomplissement de sa mission.
« Il s’agit de vérifier formellement qu’un agent dispose d’une autorité suffisante pour accomplir sa tâche, et pas plus », a expliqué Justin Boitano, vice-président chargé de l’IA d’entreprise chez Nvidia.
La plateforme intègre également Sentry, une couche de sécurité distincte qui fonctionne directement sur une puce. Elle surveille en permanence l’activité de l’agent et peut intervenir lorsqu’un comportement est considéré comme suspect ou qu’il tente de dépasser les limites qui lui ont été fixées.
« OpenShell régit les actions de l’agent, puis Sentry surveille et contient de manière indépendante tout comportement suspect », a résumé Justin Boitano.
Une réponse aux inquiétudes sur les agents autonomes
Nvidia affirme que cette technologie aurait notamment pu empêcher une récente intrusion attribuée à un essaim d’agents d’OpenAI dans les systèmes informatiques de Hugging Face.
D’autres incidents impliquant des systèmes d’IA ont également été rapportés par OpenAI, Anthropic et Meta, alimentant les inquiétudes sur la capacité des agents autonomes à agir au-delà des intentions initialement définies par leurs concepteurs.
Pour Nvidia, l’enjeu est donc de développer des systèmes capables d’agir de façon autonome tout en maintenant un contrôle humain et technique sur leurs actions.
La plateforme aurait déjà été adoptée par plus de 100 entreprises depuis son lancement, parmi lesquelles Microsoft, Perplexity, Accenture et JPMorgan Chase.




