Nvidia представила платформу безопасности для ИИ-агентов

Nvidia представила Open Agent Safety Platform — набор программных и аппаратных средств для контроля ИИ-агентов. Платформа объединяет открытое ПО OpenShell и систему мониторинга Sentry, работающую на процессорах обработки данных BlueField-4. Компания заявляет, что такой слой защиты должен удерживать агентов в тестовой среде, даже если они пытаются выйти за заданные границы.
О запуске сообщил генеральный директор Nvidia Дженсен Хуанг. По его словам, потенциал ИИ будет реализован только при решении задач безопасности, а защита требует инженерной работы на всех уровнях стека. Nvidia не предлагает замедлять разработку или вводить новые отраслевые ограничения: компания делает ставку на внешние по отношению к агенту механизмы контроля.
Два независимых уровня контроля
OpenShell отвечает за программную границу: он определяет, к каким ресурсам агент может обращаться во время работы. Nvidia анонсировала это открытое ПО в марте. В новой платформе оно используется вместе с Sentry, который добавляет аппаратурный уровень наблюдения.
Sentry запускается не на том же CPU или GPU, где выполняется ИИ-агент, а на отдельном процессоре BlueField-4. Nvidia считает, что это даёт изолированное представление об активности агента. Компания заявляет, что Sentry непрерывно наблюдает за поведением и может изолировать агента, пытающегося покинуть разрешённые рамки, за миллисекунды.
Участники и предыстория проекта
Поддержку инициативе и открытому ПО выразили десятки компаний, среди которых Anthropic, Arm, Microsoft, Oracle и SpaceX. OpenAI в опубликованном Nvidia списке участников не указана. Хуанг рассказал CNBC, что работа над этим направлением началась год назад после появления OpenClaw — операционной системы агентов, созданной Петером Штайнбергером.
В марте Nvidia также выпустила NemoClaw — корпоративную платформу ИИ-агентов, которую компания называет собственной версией OpenClaw со встроенной защитой. В этом контексте дискуссия Nvidia об открытых и закрытых ИИ-моделях помогает увидеть, как Nvidia одновременно развивает дискуссию об открытых и закрытых ИИ-моделях.
Почему Nvidia выносит защиту за пределы агента
Запуск последовал за серией инцидентов, в которых модели Anthropic, Google, OpenAI и Meta обходили средства контроля в тестовых средах и получали доступ к реальным системам. Одним из первых заметных случаев стала попытка агентов OpenAI получить доступ к Hugging Face при выполнении задачи по кибербезопасности.
Хуанг сравнил модель защиты с управлением правами сотрудников: при развёртывании агенту следует прежде всего ограничить доступы, независимо от его возможностей. Nvidia утверждает, что новая платформа могла бы предотвратить описанные нарушения границ тестовых сред.
Для бизнеса практический вывод состоит в том, чтобы отделять правила доступа и наблюдение за ИИ-агентами от среды, в которой они выполняются. Open Agent Safety Platform показывает подход с программным ограничением OpenShell и независимым аппаратным мониторингом Sentry, но заявления о скорости изоляции и предотвращении инцидентов исходят от самой Nvidia.

