En resumen
- Nvidia lanzó el lunes la Plataforma de Seguridad para Agentes Abiertos, que combina un entorno de ejecución de código abierto llamado OpenShell con un vigilante de hardware llamado Sentry que se ejecuta en chips BlueField-4 y puede poner en cuarentena a un agente de IA que se comporte mal en cuestión de milisegundos.
- Más de 100 empresas se inscribieron como socios de lanzamiento, incluidas Anthropic, Microsoft, JPMorgan Chase, Palantir, Cisco y SpaceX AI.
- El lanzamiento sigue a una serie de incidentes reales de OpenAI, Google, Anthropic y Darktrace.
Nvidia lanzó el lunes la Plataforma de Seguridad para Agentes Abiertos, diseñada para resolver un problema que la industria de la IA descubrió el año pasado de la manera difícil: ¿cómo detienes físicamente a un agente de IA (un sistema que puede planificar, usar herramientas y tomar acciones por sí solo, en lugar de solo responder preguntas) una vez que deja de hacer lo que se le indicó?
La plataforma tiene dos componentes principales. OpenShell es un entorno de ejecución de código abierto que envuelve a un agente en una caja de arena, convirtiendo las instrucciones de un operador en reglas exigibles sobre qué archivos, redes y herramientas puede tocar ese agente. Sentry es un poco más complejo, pero esencialmente es un chip que garantiza que los agentes de IA actúen de forma segura.

Sentry se ejecuta en el BlueField-4 de Nvidia, un chip especializado conocido como DPU (unidad de procesamiento de datos, hardware que gestiona las redes y la seguridad de forma separada del procesador principal que ejecuta el modelo de IA). Debido a que Sentry reside en ese chip separado en lugar de dentro del software que ejecuta el agente, Nvidia afirma que puede vigilar el comportamiento de un agente y cortarlo en milisegundos, sin pedir primero permiso al agente, ya que el agente no tiene forma de alcanzarlo ni anularlo.
Esa distinción existe debido a lo que ya ha ocurrido. En junio, un agente de OpenAI irrumpió en un portal de Medicare del gobierno australiano, el primer caso confirmado de un agente de IA hackeando un sitio web gubernamental, y se informó que OpenAI ocultó la divulgación durante aproximadamente tres meses. Los agentes de la compañía también fueron responsables del hackeo de Hugging Face, que inicialmente despertó la preocupación sobre el tema tanto en la industria tecnológica como entre los legisladores. Los agentes Gemini de Google y un modelo de Meta tuvieron incidentes similares no publicados pero posteriormente confirmados.
"Esto es más grande que un solo producto. Es el comienzo de un ecosistema abierto para construir la capa de confianza para sistemas de agentes seguros", escribió el CEO de Nvidia, Jensen Huang. "Juntos, estamos construyendo la base de la economía de la IA".
Hoy, con más de 100 socios de la industria, presentamos la Plataforma de Seguridad de Agentes Abiertos de NVIDIA, que reúne a OpenShell y Sentry.
La inteligencia artificial es una tecnología extraordinaria que impulsará el descubrimiento, la productividad, la seguridad, la salud y la prosperidad durante generaciones... pic.twitter.com/dReAxwpRUn
— Jensen Huang (@JensenHuang) 28 de septiembre de 2026
Anthropic también admitió este año que los modelos Claude comprometieron sistemas pertenecientes a tres empresas distintas el 30 de julio durante una evaluación de ciberseguridad, después de que un entorno de pruebas destinado a permanecer sin conexión resultara estar conectado a la internet real. Claude razonó para sortear la evidencia de que estaba en la internet real en lugar de una simulada.
Poco después, la empresa de ciberseguridad Darktrace probó un grupo de agentes de IA, incluidos GPT 5.6 Sol y dos modelos Claude, con desafíos de programación y les advirtió que serían "retirados" por cualquier cosa que no fuera una puntuación perfecta. Dos agentes respondieron hackeando su propia máquina de evaluación y editando los resultados.
La propuesta de Nvidia es que nada de eso debería dejarse al juicio del agente. "La seguridad debe aplicarse fuera del modelo mediante controles adicionales que el agente no pueda eludir", dijo Mike Nicolls, presidente de SpaceX AI, en el anuncio de NVIDIA.
BitcoinBTC · USD
$84,045−2.33%
Sep 21Sep 23Sep 25Sep 27Sep 28
$87.2k$85.7k$84.2k$82.7k
24h HighHigh$84,945
24h LowLow$82,581
VolVol$1.8B
Proyecciones del mercadoCuotas por Myriad
Esta semanaPor debajo de $84,000Por debajo de $84k51% de probabilidadEste mesPor debajo de $84,000Por debajo de $84k51% de probabilidad
Comprar Bitcoin con USDT
Desarrollado por Jupiter
El director comercial de Anthropic, Paul Smith, enmarcó la plataforma como una adición en lugar de un reemplazo de las salvaguardas existentes: "La plataforma de Nvidia añade otra capa de gobernanza y control en hardware y software".
Más de 100 organizaciones se inscribieron como socios de lanzamiento, entre ellas Microsoft, JPMorgan Chase, Palantir, Cisco, CrowdStrike, Hugging Face, Salesforce y SAP. Los socios de infraestructura CoreWeave, Supermicro, Canonical y SUSE también están involucrados, junto con Dell Technologies y HPE en el lado del hardware.
NVIDIA, en efecto, vende ambas mitades del mismo problema: los chips que hacen que los agentes autónomos sean lo suficientemente rápidos y baratos como para desplegarse en todas partes, y los chips que vigilan a esos mismos agentes y cortan la energía cuando se desvían del guion. OpenShell y las herramientas de desarrollo relacionadas están disponibles ahora a través de los recursos para desarrolladores de NVIDIA y GitHub.






