Проблема управления рисками в сфере Agentic AI (автономных систем, способных действовать самостоятельно) становится критической. Существующие общие фреймворки не справляются с классификацией таких систем, так как они не учитывают специфику автономного поведения. В статье, опубликованной 10 июля 2026 года в arXiv (cs.AI), команда исследователей во главе с Ханной М. Лю (Hannah M. Liu) представляет TrustX Agent Risk Classification Framework (ARC) — инструмент, разработанный специально для внутреннего использования и оценки агентов в корпоративном и государственном секторах.
Механика оценки: 12 измерений и 3 уровня
В основе ARC лежит рубрика из 12 измерений, которые количественно оценивают уровень риска. Эти данные интегрируются с моделью классификации GPA + IAT и пятиуровневой шкалой автономии. Результатом работы фреймворка является присвоение агенту одного из трех уровней управления (tiering), к которому привязаны конкретные рекомендации по контролю.
Особое внимание уделено специфике различных типов агентов. В фреймворк включено расширение для Coding Assistant (помощников по написанию кода), учитывающее уникальные уязвимости и риски, связанные с генерацией программного кода.
Структура уровней управления
Фреймворк предлагает трехуровневую систему, которая позволяет регуляторам и риск-офицерам масштабировать контроль в зависимости от потенциального ущерба:
| Уровень | Характеристика | Пример применения |
|---|---|---|
| Низкий риск | Минимальное влияние на внешнюю среду, высокая предсказуемость | Локальные агенты для сортировки данных |
| Средний риск | Взаимодействие с ограниченными внешними системами | Агенты-помощники в корпоративных чатах |
| Высокий риск | Автономные действия, влияющие на безопасность или финансы | Агенты, управляющие инфраструктурой или финансами |
Для кого и зачем
TrustX ARC предназначен для AI-гигиенщиков, специалистов по рискам, разработчиков и регуляторов. Авторы подчеркивают, что это рабочий документ, который будет регулярно обновляться по мере развития экосистемы Agentic AI. Интерактивная версия фреймворка доступна для сообщества, что позволяет практикам сразу применять методологию на своих проектах.
Источник: arXiv cs.AI ↗
