Новый стандарт для агентов ИИ: что такое SAFE?
На фоне конференции Black Hat в Лас-Вегасе Linux Foundation опубликовала Request for Comments (RFC) для системы Shared AI Findings Exchange (SAFE). Инициатива направлена на создание единого протокола обмена данными об инцидентах кибербезопасности, связанных с AI-агентами. В альянсе уже более 120 организаций, включая NVIDIA, Cisco, CrowdStrike, Hugging Face и Red Hat.
Ключевая цель SAFE — трансформировать разрозненные инциденты в коллективную защиту. Система предполагает конфиденциальный сбор данных об инцидентах и «почти-инцидентах» (near misses), информирование пострадавших сторон, выявление повторяющихся сбоев контроля и публикацию рекомендаций, основанных на доказательствах, для снижения системных рисков.
Полный стек безопасности от NVIDIA
NVIDIA демонстрирует подход к безопасности «от модели до рантайма», предоставляя открытые инструменты для каждого уровня стека AI-агентов. Агенты — это не просто модели, а сложные системы, требующие контроля идентичности, ограничений (guardrails) и логирования.
- NOOA (NVIDIA Labs Object-Oriented Agent): исследовательский хаб на GitHub для тестирования, отслеживания и аудита поведения агентов.
- NVIDIA OpenShell: среда выполнения, ограничивающая доступ агентов к данным и ресурсам, обеспечивая безопасность на уровне рантайма.
- Открытые модели: семейства Nemotron (agentic AI), Cosmos (physical AI), Isaac GR00T (робототехника) и Alpamayo (автономные транспортные средства) поставляются с открытыми весами и данными.
- Verified Agent Skills: криптографически подписанные наборы инструкций, отсканированные на риски (prompt injection, poisoning) с документацией (skill card).
- Инструменты NeMo и Garak: для enforcement политик безопасности, анонимизации данных и сканирования моделей на утечки и jailbreak-уязвимости.
Вклад других участников альянса
Другие члены альянса закрывают специфические слои безопасности, от управления доступом до автоматизированного red teaming. Ниже приведена сводка ключевых инструментов:
| Уровень безопасности | Компания | Инструмент / Проект | Функционал |
|---|---|---|---|
| Идентичность и доступ | Okta | Cross App Access (XAA) | Открытый протокол для безопасного подключения агентов к корпоративным приложениям. |
| Идентичность и доступ | Palo Alto Networks | Agent Guard / Agent Watch | Инструменты для применения лучших практик безопасности идентичности и безопасного получения секретов. |
| Идентичность и доступ | Red Hat | asago | Маппинг требований (NIST, OWASP, EU AI Act) к действиям агентов в рантайме с единым аудиторским следом. |
| Харнесы и оркестрация | Amazon | Strands Agents / Cedar | Открытый тулкит для агентов и язык авторизации для детерминированных границ доступа. |
| Харнесы и оркестрация | Microsoft | PyRIT / RAMPART / Clarity | Автоматизированный red teaming, превращение инцидентов в тесты, выявление ошибок проектирования. |
| Харнесы и оркестрация | Wiz | Atlas | Автономный движок уязвимостей, использующий AI-агентов для поиска дыр в коде. |
| Модели безопасности | Cisco | DefenseClaw / Antares | Агентный слой управления безопасностью и малые языковые модели для поиска уязвимостей в коде. |
Почему это важно?
Кибербезопасность AI-агентов — это «гонка без финишной черты». Традиционные методы сканирования уязвимостей недостаточны, так как агенты действуют автономно и быстро. Стандарт SAFE и открытый стек инструментов от NVIDIA и партнеров позволяют защитникам действовать «на скорости агентов» (agent speed). Открытый обмен разведданными об угрозах становится мультипликатором коллективной обороны, превращая инциденты одной компании в защиту для всей экосистемы.
Источник: NVIDIA Blog ↗
