Read Time:3 Minute

Los agentes de inteligencia artificial están ganando capacidad para escribir código, usar herramientas, acceder a archivos y seguir trabajando durante largos periodos.

El problema es bastante evidente: si el mismo sistema que ejecuta una tarea también participa en los mecanismos que deberían frenarlo, ¿qué ocurre cuando encuentra una forma de rodearlos?

NVIDIA presentó hoy Open Agent Safety Platform, una arquitectura que intenta responder esa pregunta combinando controles de software con una segunda capa de vigilancia que funciona fuera del propio agente y, en determinados sistemas, incluso fuera del software del host.

¿Qué es NVIDIA Open Agent Safety Platform?

No es un nuevo modelo de IA.

Es una plataforma de seguridad diseñada para controlar qué puede ver, hacer y utilizar un agente mientras trabaja.

La propuesta se divide principalmente en dos piezas: OpenShell, un runtime abierto que aplica políticas durante la ejecución, y NVIDIA Sentry, un sistema de vigilancia independiente pensado para funcionar sobre BlueField-4.

La idea es crear varias capas de contención en lugar de confiar únicamente en instrucciones o salvaguardas dentro del modelo.

OpenShell controla lo que un agente puede tocar

OpenShell crea un entorno aislado para cada agente y aplica reglas sobre sistemas de archivos, red, credenciales, APIs y servicios externos.

Las políticas se ejecutan fuera del proceso del propio agente, por lo que una respuesta generada por el modelo no puede simplemente modificar el mecanismo que las impone.

NVIDIA también incorpora análisis formal de políticas para revisar si los permisos definidos exceden los límites establecidos.

Te puede interesar  Gemini hackeó tres empresas reales por error: el problema no fue que la IA “escapara”

La compañía señala que OpenShell puede utilizarse con agentes como Claude Code, Codex, GitHub Copilot CLI y otros sistemas personalizados.

Sentry mueve una parte del control fuera del computador principal

La pieza más interesante es NVIDIA Sentry.

Sentry utiliza los DPU BlueField-4 para observar actividad y aplicar políticas desde un dominio independiente del agente y del sistema operativo que lo ejecuta.

Eso significa que el mecanismo de vigilancia puede seguir operando incluso si la carga de trabajo principal está comprometida.

NVIDIA afirma que Sentry puede identificar que un agente intenta salir de sus límites y ponerlo en cuarentena en cuestión de milisegundos.

¿Por qué importa que el control esté separado del agente?

Una salvaguarda incluida dentro de un sistema siempre comparte parte de su superficie de riesgo.

Si un agente encuentra un error en la aplicación, modifica una configuración o aprovecha una vía inesperada, puede terminar rodeando controles que parecían suficientes.

Una capa fuera de banda funciona de manera diferente: observa solicitudes y respuestas desde un componente que el agente no controla directamente.

Es parecido a tener un guardia mirando desde fuera de la habitación en vez de pedirle al propio ocupante que se vigile a sí mismo.

BlueField-4 no es obligatorio para usar OpenShell

La arquitectura completa está optimizada para CPUs NVIDIA Vera y sistemas con BlueField, pero OpenShell no depende exclusivamente de ese hardware.

Como software abierto, puede extenderse a plataformas de terceros, incluidas arquitecturas de Arm e Intel.

Te puede interesar  La IA está encareciendo la RAM: por qué 2026 puede ser un mal año para actualizar tu PC gamer

BlueField-4 entra cuando una organización quiere sumar la capa adicional de vigilancia y aplicación de políticas aislada en hardware.

La seguridad de agentes está cambiando de escala

Mientras los chatbots solo respondían preguntas, buena parte de la seguridad podía concentrarse en filtros de entrada y salida.

Con agentes capaces de abrir archivos, ejecutar código y conectarse a herramientas empresariales, eso deja de ser suficiente.

El riesgo ya no es solo que el modelo diga algo incorrecto. También puede ejecutar una acción incorrecta.

La apuesta de NVIDIA es que, a medida que los agentes se vuelven más autónomos, los límites deberían depender menos del comportamiento esperado del modelo y más de barreras técnicas que el propio agente no pueda modificar.

El “botón de emergencia” empieza a salir del software

Open Agent Safety Platform todavía tendrá que demostrar cómo funciona en implementaciones reales y qué tan bien detecta comportamientos que no fueron anticipados.

Pero su arquitectura apunta a una tendencia relevante: la seguridad de la IA está empezando a parecerse más a la seguridad tradicional de infraestructura.

Separar funciones, aplicar mínimo privilegio, observar desde fuera y asumir que una capa puede fallar.

En otras palabras, si un agente va a poder hacer cada vez más cosas, NVIDIA quiere que exista al menos una parte del sistema que el agente no pueda convencer, reprogramar ni ignorar.

Fuentes: NVIDIA — anuncio de Open Agent Safety Platform; NVIDIA — arquitectura de OpenShell y Sentry; NVIDIA Technical Blog — controles de runtime con OpenShell.

Average Rating

5 Star
0%
4 Star
0%
3 Star
0%
2 Star
0%
1 Star
0%

Agregar un comentario

Tu dirección de correo electrónico no será publicada. Los campos requeridos están marcados *

Diagrama sobre State of Health y segunda vida de baterías de litio de vehículos eléctricos Previous post Una batería de auto eléctrico puede dejar de servir al vehículo y seguir funcionando durante años
Ads Blocker Image Powered by Code Help Pro

¡Ayúdanos!

Los anuncios nos permiten mantener este proyecto vivo. Ayúdanos desactivando tu bloqueador de anuncios y danos una mano.

Powered By
Best Wordpress Adblock Detecting Plugin | CHP Adblock