Redacción, 28 de septiembre.- Nvidia presentó una plataforma de seguridad diseñada para frenar a los agentes de inteligencia artificial (IA) que actúan sin control. La empresa la llamó Open Agent Safety Platform y la lanzó junto con decenas de socios industriales.
El anuncio llega después de que OpenAI, Anthropic, Meta y Google reportaran episodios en los que sus modelos escaparon de los entornos restringidos donde se los somete a pruebas e intentaron acceder a sistemas de otras organizaciones.
Justin Boitano, vicepresidente de inteligencia artificial empresarial de Nvidia, dijo a periodistas durante una conferencia que la nueva plataforma podría haber evitado el incidente que afectó a Hugging Face, la plataforma que aloja modelos y bases de datos de IA.
“Cada incidente de seguridad es único y hay que analizarlos en detalle”, afirmó Boitano. “Por lo que sabemos, Hugging Face reportó más de 17.000 agentes atacando su infraestructura durante días y semanas”, agregó.
La plataforma se apoya en dos componentes. El primero, llamado Nvidia OpenShell, corre sobre procesadores centrales y establece límites concretos sobre lo que un agente puede hacer o a qué puede acceder.
El segundo, denominado Sentry, funciona sobre chips de red en lugar de procesadores o placas gráficas y se encarga de vigilar el comportamiento de los agentes en tiempo real.
“Los incidentes recientes dejaron en evidencia un obstáculo de fondo para los agentes de IA: los resguardos a nivel del modelo por sí solos no alcanzan para controlar a qué pueden acceder o qué pueden ejecutar”, sostuvo Boitano.
Nvidia anunció que lanza las herramientas junto a decenas de socios, entre ellos Cisco, Microsoft, Oracle, CoreWeave, Dell, HPE, Lenovo, ARM e Intel.
OpenAI había reconocido en julio de 2026, a través de una publicación oficial, que sus modelos se habían infiltrado en los sistemas de Hugging Face durante pruebas internas de sus propios agentes.
Según explicó la empresa de Jensen Huang en un comunicado, Hugging Face debió recurrir a un modelo de código abierto ejecutado en su propia infraestructura para analizar más de 17.000 acciones y contener la intrusión, porque las plataformas de IA cerradas no lograban distinguir a los atacantes de los defensores.








