Nvidia строит безопасность AI-агентов вокруг проверяемых ограничений инфраструктуры

Open Agent Safety Platform сочетает открытую песочницу OpenShell с аппаратным мониторингом Sentry. Nvidia приводит примеры внедрения, но защита Sentry зависит от оборудования BlueField-4.

Политики исполняются вне модели

Open Agent Safety Platform объединяет OpenShell и Sentry. OpenShell запускает каждого агента в отдельной песочнице и контролирует его обращения к файлам, процессам, сети, учётным данным, инструментам и моделям. Организация задаёт политику, а среда принудительно применяет её и ведёт журнал решений. OpenShell доступен с открытым исходным кодом по лицензии Apache 2.0 и работает на существующем оборудовании.

Внедрения и роль Sentry

Sentry — аппаратная схема наблюдения для BlueField-4, отдельная от основного компьютера. Nvidia сообщает, что более 100 компаний работают с платформой. SpaceXAI использует её для агентов Cursor и моделей Grok; Salesforce интегрировала OpenShell со Slack, SAP — со средой Joule Studio. Canonical, SUSE и Red Hat, по словам Nvidia, интегрируют платформу в свои операционные системы. Эти примеры описывают заявленную работу с платформой, но не являются независимой оценкой эффективности.

Практические границы

Для начала организации могут использовать OpenShell без Sentry. Аппаратные средства защиты требуют BlueField-4, а формальная проверка политик пока охватывает не все возможности. Nvidia также продолжает работу над контролем нескольких взаимодействующих агентов. Компания утверждает, что инфраструктура может остановить некоторые выходы из песочницы, однако приведённые примеры не доказывают, что система предотвратила бы конкретные инциденты.

Nvidia's Open Agent Safety Platform bets agents can't police themselves, so the infrastructure has to | VentureBeat