NVIDIA presentó Open Agent Safety Platform, una plataforma para fijar y hacer cumplir límites a los agentes de Inteligencia Artificial mientras trabajan. Reúne un programa abierto llamado OpenShell y un diseño de supervisión apoyado en hardware llamado Sentry.
Un agente de IA es un sistema que puede encadenar acciones, como consultar archivos, ejecutar programas o conectarse a servicios para completar una tarea. Ese acceso le permite trabajar durante más tiempo, pero también amplía el daño posible si usa un permiso de manera indebida o recibe instrucciones maliciosas.
Más de 100 organizaciones trabajan con tecnologías de la plataforma, según NVIDIA. Entre ellas figuran Microsoft, Anthropic, Cisco y Salesforce. La cifra describe una colaboración en torno a herramientas y prácticas de seguridad; no significa que todas hayan implantado el mismo sistema ni que exista un estándar obligatorio.
Jensen Huang, fundador y director ejecutivo de NVIDIA, sostuvo en el anuncio que “la seguridad y la protección requieren ingeniería en todas las capas del sistema”. La idea central es controlar también el entorno donde opera el agente, además de las reglas escritas en sus instrucciones.
OpenShell limita archivos, conexiones y credenciales de los agentes
OpenShell ejecuta cada agente en un espacio aislado. Quien lo administra define por anticipado qué carpetas puede usar, a qué direcciones de internet puede conectarse y qué servicios puede consultar. El programa aplica esas reglas mientras el agente actúa, aunque el propio agente intente hacer algo distinto.
La protección también alcanza a las credenciales, las claves que permiten entrar a servicios externos. OpenShell puede entregar una clave solo cuando la solicitud va al destino autorizado. Así, una instrucción maliciosa que trate de enviar datos a otra dirección encuentra una barrera fuera del modelo de IA.

NVIDIA publicó OpenShell como software de código abierto. Su repositorio oficial en GitHub ofrece el código y las instrucciones de instalación, y la documentación explica sus reglas de acceso. Está pensado para equipos que desarrollan o administran agentes, no como una función que se active con un botón en cualquier chatbot.
El repositorio indica compatibilidad con Linux y computadores Mac con chips Apple. También contempla Windows mediante WSL 2, un entorno de Linux dentro de Windows, en fase experimental. La instalación requiere además un sistema de contenedores o virtualización. OpenShell puede extenderse a procesadores de terceros, incluidos los de Arm e Intel.
Sentry añade vigilancia independiente mediante hardware
La otra pieza, Sentry, es un diseño de referencia que usa los procesadores BlueField-4 de NVIDIA para vigilar la actividad del agente desde un componente separado. Si detecta un intento de salir de los límites establecidos, NVIDIA afirma que puede aislarlo en milisegundos. Esa velocidad es una capacidad anunciada por la empresa, no una garantía de que toda amenaza quede detenida.
Separar la vigilancia del programa principal busca impedir que el propio agente cambie las reglas que lo controlan. Sentry puede revisar solicitudes, comprobar la identidad de un agente y aplicar permisos precisos sobre datos, herramientas y servicios. Su despliegue depende de infraestructura compatible y de la configuración de cada organización.
NVIDIA ofrece el software de la plataforma, incluido OpenShell, mediante sus recursos para desarrolladores y GitHub. Las organizaciones pueden incorporar componentes según sus necesidades. Salesforce, por ejemplo, anunció una integración que permite ver actividad y solicitudes de permisos de agentes desde Slack.
El anuncio se suma a los debates sobre los agentes de IA que operan con acceso a información y servicios reales. En este caso, la novedad verificable es la combinación de reglas aplicadas durante la ejecución, vigilancia separada y colaboración entre proveedores.
Fuentes
Anuncio de NVIDIA · Documentación oficial de OpenShell · Repositorio oficial


