Исследования4 августа 2026 г., 16:16 МСК🤖 Auto

NVIDIA и 120+ компаний создают стандарт безопасности AI-агентов SAFE

Альянс Open Secure AI Alliance, объединяющий NVIDIA, Cisco, Hugging Face и другие гиганты, представил проект руководств SAFE для прозрачности кибербезопасности агентов ИИ.

Баннер новости 5044

Новый стандарт для агентов ИИ: что такое SAFE?

На фоне конференции Black Hat в Лас-Вегасе Linux Foundation опубликовала Request for Comments (RFC) для системы Shared AI Findings Exchange (SAFE). Инициатива направлена на создание единого протокола обмена данными об инцидентах кибербезопасности, связанных с AI-агентами. В альянсе уже более 120 организаций, включая NVIDIA, Cisco, CrowdStrike, Hugging Face и Red Hat.

Ключевая цель SAFE — трансформировать разрозненные инциденты в коллективную защиту. Система предполагает конфиденциальный сбор данных об инцидентах и «почти-инцидентах» (near misses), информирование пострадавших сторон, выявление повторяющихся сбоев контроля и публикацию рекомендаций, основанных на доказательствах, для снижения системных рисков.

Полный стек безопасности от NVIDIA

NVIDIA демонстрирует подход к безопасности «от модели до рантайма», предоставляя открытые инструменты для каждого уровня стека AI-агентов. Агенты — это не просто модели, а сложные системы, требующие контроля идентичности, ограничений (guardrails) и логирования.

  • NOOA (NVIDIA Labs Object-Oriented Agent): исследовательский хаб на GitHub для тестирования, отслеживания и аудита поведения агентов.
  • NVIDIA OpenShell: среда выполнения, ограничивающая доступ агентов к данным и ресурсам, обеспечивая безопасность на уровне рантайма.
  • Открытые модели: семейства Nemotron (agentic AI), Cosmos (physical AI), Isaac GR00T (робототехника) и Alpamayo (автономные транспортные средства) поставляются с открытыми весами и данными.
  • Verified Agent Skills: криптографически подписанные наборы инструкций, отсканированные на риски (prompt injection, poisoning) с документацией (skill card).
  • Инструменты NeMo и Garak: для enforcement политик безопасности, анонимизации данных и сканирования моделей на утечки и jailbreak-уязвимости.

Вклад других участников альянса

Другие члены альянса закрывают специфические слои безопасности, от управления доступом до автоматизированного red teaming. Ниже приведена сводка ключевых инструментов:

Уровень безопасности Компания Инструмент / Проект Функционал
Идентичность и доступ Okta Cross App Access (XAA) Открытый протокол для безопасного подключения агентов к корпоративным приложениям.
Идентичность и доступ Palo Alto Networks Agent Guard / Agent Watch Инструменты для применения лучших практик безопасности идентичности и безопасного получения секретов.
Идентичность и доступ Red Hat asago Маппинг требований (NIST, OWASP, EU AI Act) к действиям агентов в рантайме с единым аудиторским следом.
Харнесы и оркестрация Amazon Strands Agents / Cedar Открытый тулкит для агентов и язык авторизации для детерминированных границ доступа.
Харнесы и оркестрация Microsoft PyRIT / RAMPART / Clarity Автоматизированный red teaming, превращение инцидентов в тесты, выявление ошибок проектирования.
Харнесы и оркестрация Wiz Atlas Автономный движок уязвимостей, использующий AI-агентов для поиска дыр в коде.
Модели безопасности Cisco DefenseClaw / Antares Агентный слой управления безопасностью и малые языковые модели для поиска уязвимостей в коде.

Почему это важно?

Кибербезопасность AI-агентов — это «гонка без финишной черты». Традиционные методы сканирования уязвимостей недостаточны, так как агенты действуют автономно и быстро. Стандарт SAFE и открытый стек инструментов от NVIDIA и партнеров позволяют защитникам действовать «на скорости агентов» (agent speed). Открытый обмен разведданными об угрозах становится мультипликатором коллективной обороны, превращая инциденты одной компании в защиту для всей экосистемы.

Источник: NVIDIA Blog ↗