Главная/Блог/Обзор/Guardrails в OpenRouter: защита…
Обзор3 мин чтения · 7 июля 2026 г.

Guardrails в OpenRouter: защита бюджета, данных и моделей

Как настроить бюджетные лимиты, Zero Data Retention и защиту от инъекций в OpenRouter без изменения кода агентов.

Guardrails в OpenRouter: защита бюджета, данных и моделей

OpenRouter представил инструмент Guardrails — набор конфигурируемых правил безопасности и управления для рабочих пространств (workspaces). Это решение позволяет централизованно контролировать расходы, обеспечивать конфиденциальность данных (Zero Data Retention, ZDR), блокировать нежелательные модели и защищать от prompt-инъекций. Ключевое преимущество: все правила применяются на уровне API, что исключает необходимость менять код ваших AI-агентов.

01Контроль бюджета (Budget Enforcement)

Guardrails позволяют устанавливать жесткие лимиты расходов с возможностью сброса по дням, неделям или месяцам. Запросы, превышающие лимит, получают ответ 402. Это критически важно для предотвращения сценариев, когда один «беглый» скрипт или цикл агента исчерпывает месячный бюджет.

Бюджеты привязываются к сущностям (API-ключам или пользователям) и не являются общими для всего воркспейса. Лимиты накладываются друг на друга:

  • Лимит пользователя: Например, $100/день для сотрудника.
  • Лимит ключа: Например, $30/день для конкретного ключа API.

В этом примере ключ не потратит больше $30, а общий расход пользователя по всем его ключам не превысит $100. Проверка происходит на каждом запросе.

💡
Экономия на масштабе. Назначьте лимит $50/день трем членам команды. Каждый получит свой независимый лимит $50, а не общий пул на всех. Это предотвращает конфликты ресурсов внутри отдела.

02Конфиденциальность и выбор провайдеров (ZDR & Restrictions)

Инструмент позволяет мгновенно отключить все эндпоинты, которые сохраняют или используют данные для обучения. Также можно заблокировать отдельных провайдеров или модели, оставив только проверенные (allowlist). Запросы к запрещенным ресурсам получают ответ 404.

Важно: настройки приватности на уровне аккаунта наследуются по умолчанию. Guardrails могут быть только более строгими, но не менее строгими, чем глобальные политики аккаунта.

03Защита от инъекций (Prompt Injection Defense)

Система сканирует входные данные по более чем 30 регулярным выражениям, основанным на OWASP LLM Prompt Injection Prevention Cheat Sheet. Алгоритм детерминирован и добавляет пренебрежимо малую задержку. Он выявляет:

  • Типогликемию (намеренные опечатки).
  • Кодирование (base64, hex и т.д.).
  • Разделение символов (character-spaced evasion).

Детекция происходит до отправки запроса провайдеру. Если срабатывает фильтр, трафик не покидает OpenRouter. Доступны три режима действий:

  1. Flag: Запрос проходит, но событие логируется (для аудита).
  2. Redact: Подозрительные части заменяются на [PROMPT_INJECTION].
  3. Block: Полный отказ с кодом 403 и метаданными о типе угрозы.
⚠️
Безопасность агентов. Если ваши агенты передают пользовательский ввод модели «как есть», включите режим block для regex-паттернов инъекций, чтобы избежать компрометации системных промптов.

04Предотвращение утечек данных (DLP)

Модуль DLP обнаруживает PII (персональные данные) и чувствительную информацию. Используются встроенные паттерны и поддержка пользовательских регулярных выражений для корпоративных кодов или IP.

Тип данных Метод Замена (Redact)
Email Regex [EMAIL]
Телефон Regex [PHONE]
ИНН/SSN Regex [SSN]
Номер карты Regex [CREDIT_CARD]
IP-адрес Regex [IP_ADDRESS]
Имя человека NLP (Presidio) [PERSON_NAME]
Адрес NLP (Presidio) [ADDRESS]

Регулярные выражения работают мгновенно. Обработка имен и адресов через NLP (Presidio) добавляет задержку, пропорциональную размеру ввода.

05Настройка через API

Guardrails можно назначать на группы ключей API или сотрудников. Для автоматизации (например, при онбординге) используйте Management API. Ниже пример создания правила production-safety с лимитом $100/день, списком разрешенных моделей и фильтрами контента.

Команда создает правило, блокирует кредитные карты, редатирует email и блокирует инъекции:

terminalbash
curl https://openrouter.ai/api/v1/guardrails \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
  "name": "production-safety",
  "limit_usd": 100,
  "reset_interval": "daily",
  "allowed_models": [
    "anthropic/claude-sonnet-4.6",
    "openai/gpt-5.4",
    "google/gemini-3.1-pro-preview"
  ],
  "content_filter_builtins": [
    {"slug": "regex-prompt-injection", "action": "block"},
    {"slug": "email", "action": "redact"},
    {"slug": "credit-card", "action": "block"}
  ]
}'

06Кому подойдёт / что запустится

  • Enterprise-команды: Для соблюдения GDPR и внутренних политик безопасности (ZDR, DLP).
  • Разработчики AI-агентов: Для защиты от prompt-инъекций без изменения логики приложения.
  • Стартапы: Для жесткого контроля burn rate через лимиты на ключи API.

Инструмент доступен в разделе Workspaces > Guardrails или через API. Поддерживает модели Anthropic, OpenAI, Google и других провайдеров, доступных через OpenRouter.

Источник: OpenRouter ↗