Nvidia (NVDA) запустила свою платформу Open Agent Safety Platform в понедельник, чтобы сдерживать автономных агентов с минимальным контролем со стороны людей, которые выполняют код, переводят средства или взаимодействуют с системами повышенной чувствительности.

Ключевые выводы

  • В понедельник Nvidia запустила платформу Open Agent Safety Platform для автономных агентов, которые выполняют код, переводят средства или получают доступ к системам повышенной чувствительности

  • Платформа сочетает OpenShell — изолированную среду выполнения — с Sentry, уровнем мониторинга

  • OpenShell изолирует выполнение каждого агента, чтобы нарушение не могло распространиться на хранилище, контейнеры или более широкую сеть

  • Vision One от TrendAI теперь охватывает агентов, модели, контейнеры, хранилища и сети в единой панели управления

Nvidia подробно описала платформу как песочничный рантайм OpenShell в связке с Sentry — слоем мониторинга.

В ней OpenShell описывается как среда с нулевым доверием, где по умолчанию не разрешено ничего, в ответ на многомесячное предупреждение исследователей о том, что агентам часто выдается больше полномочий, чем требуется для задачи.

AI-агент — это программа на основе языковой модели, которая выполняет многошаговые действия: просматривает веб, пишет и запускает код или вызывает другое ПО, а не просто отвечает на запрос в чате.

Эта автономность может помочь в управлении флотом или в программировании, но также делает опасным скомпрометированного или направленного не туда агента. OpenShell изолирует выполнение каждого агента, так что нарушение в одной песочнице не может распространиться на хранилище, контейнеры или более широкую сеть, с которой он взаимодействует.

Также читайте: чиновники Китая по вопросам ИИ безопасности отвергают формулировку экзистенциального риска со стороны США

Поставщик решений по безопасности TrendAI сообщил в понедельник, что расширяет платформу Nvidia, добавляя собственный слой аналитики угроз; партнерство, которое Nvidia назвала в своем анонсе.

Vision One от TrendAI теперь охватывает агентов, модели, контейнеры, хранилища и сети в единой панели управления, расширяя покрытие, которое ранее останавливалось на уровне модели.

Почему безопасность агентова стала проблемой Nvidia, которую нужно решать

Nvidia потратила 2026 год, позиционируя себя как инфраструктурный слой под вычислительными мощностями каждого крупного AI-лаборатория. Ее дата-центры все чаще размещают агентов, созданных OpenAI, Anthropic и корпоративными заказчиками, которые выполняют финансовые транзакции и управляют инфраструктурой без того, чтобы человек утверждал каждый шаг.

Инциденты с безопасностью агентов накапливались в этом квартале, включая инцидент с агентом OpenAI, который без авторизации получил доступ к австралийскому порталу здравоохранения.

Nvidia формулирует, что защищать нужно весь агентский конвейер — «AI factory», — а не только модель.

Разрыв между безопасностью модели и платформой безопасности агентов

Большая часть расходов на безопасность ИИ была сосредоточена на фильтрации вывода чат-ботов. Агенты создают отдельный риск, потому что они действуют в реальном мире, и действие, выполненное по разрешению, не всегда можно отменить.

Nvidia заявляет, что Sentry отслеживает поведение в реальном времени и может остановить агента в середине задачи, если он отклоняется от назначенной политики; это отличает ее от реактивных инструментов, которые обнаруживают проблемы уже после того, как ущерб произошел.

Для независимых разработчиков практические вопросы остаются прежними: условия платформы, доступ и накладные расходы по производительности. Предприятиям нужно решить, стоит ли добровольно принять аппаратную блокировку на уровне устройства.

Читайте дальше: платежи для AI-агентов стартуют в Cardano с поддержкой X402