Проблема доверия к автономным агентам
Автономные AI-агенты все чаще берут на себя критически важные задачи: финансовые транзакции, коммуникацию с внешними системами и выполнение корпоративных рабочих процессов. Существующая инфраструктура полагается на федерацию идентичностей и делегированную авторизацию, что позволяет аутентифицировать рабочие нагрузки. Однако этот подход не отвечает на главный вопрос: следует ли выполнять авторизованное действие в текущем поведенческом и операционном контексте?
Архитектура AgentBound: Три независимых авторитета
AgentBound решает эту проблему, внедряя слой детерминированного управления между авторизацией и выполнением. Система оценивает каждое предлагаемое действие, используя три независимых источника истины:
- Делегированная авторизация: Стандартная проверка прав доступа.
- Поведенческие конституции, подписанные владельцем: Строгие правила, определяющие допустимое поведение агента.
- Контракты действий сайта: Локальные правила взаимодействия с конкретными ресурсами.
Решение о разрешении, проверке или блокировке действия принимается через формальную модель принятия решений, которая консервативно комбинирует результаты этих трех авторитетов.
Криптографические чеки и подотчетность
Ключевой особенностью AgentBound является генерация криптографически верифицируемых чеков управления (governance receipts). Каждый чек связывает действие с точными артефактами делегирования, политики и семантики, принявшими решение. Это позволяет:
- Проводить независимую проверку (replay verification) действий постфактум.
- Обеспечивать полную прослеживаемость происхождения политик (policy provenance).
AgentBound-Bench и долгосрочная делегация
Для оценки эффективности фреймворка исследователи представили AgentBound-Bench — бенчмарк для проверки корректности управления, композиции полномочий и подотчетности. Также введена концепция «постоянного делегирования» (standing delegation), позволяющая долгоживущим агентам работать с периодически обновляемыми политиками, сохраняя возможность их отзыва и ограничивая полномочия.
| Компонент | Описание | Функция |
|---|---|---|
| Delegated Authorization | Стандартная авторизация | Проверка прав доступа к ресурсам |
| Owner-Signed Constitutions | Поведенческие конституции | Определение допустимого контекста действий |
| Site Action Contracts | Контракты действий | Локальные правила взаимодействия |
| Governance Receipts | Криптографические чеки | Независимая верификация и аудит решений |
AgentBound не заменяет выравнивание моделей (model alignment), а дополняет его, превращая управление из процесса, которому нужно доверять, в процесс, который можно независимо проверить.
Источник: arXiv cs.AI ↗
