В эпоху, когда корпоративные данные становятся ключевым активом, вопрос приватности при использовании LLM-провайдеров выходит на первый план. Zero Data Retention (ZDR) — это не просто маркетинговый термин, а строгая политика обработки данных, при которой провайдер не сохраняет ваши промпты и ответы после генерации. Однако важно понимать: ZDR гарантирует отсутствие хранения на стороне провайдера, но не защищает ваши локальные логи или сторонние плагины. Разберем, как технически обеспечить эту политику и где кроются подводные камни.
01Что такое ZDR и что оно НЕ покрывает
Zero Data Retention означает, что после отправки ответа модель и инфраструктура провайдера удаляют или не сохраняют в постоянное хранилище ни исходный запрос, ни сгенерированный ответ. Это гарантия Retention at rest (хранения в покое).
Однако ZDR не меняет физическую природу API-запросов:
- Data in transit: Ваши данные все равно передаются по сети к серверам провайдера для обработки.
- Training on data: Хотя ZDR часто идет рука об руку с отказом от обучения, это разные вещи. Провайдер может не хранить данные, но использовать их для обучения (если политика позволяет), или хранить временно для безопасности, но не обучаться на них.
- Локальные логи: ZDR не удаляет данные из ваших собственных систем логирования, баз данных или трекеров ошибок.
02ZDR против других политик приватности
Часто путают ZDR с политикой «No Training» (без обучения). Разница критична:
| Контроль | Что регулирует | Пример сценария |
|---|---|---|
| ZDR | Хранение данных после ответа | Провайдер не сохраняет ваш промпт на сервере. |
| No Training | Использование данных для улучшения модели | Провайдер может хранить данные, но не использовать их для дообучения. |
| Data Residency | Географическое расположение серверов | Данные обрабатываются только в ЕС (GDPR), но могут сохраняться. |
Для максимальной защиты рекомендуется комбинировать ZDR с запретом на сбор данных (data_collection: "deny") и, при необходимости, привязкой к региону (in-region routing).
03Как настроить ZDR на практике (OpenRouter)
Если вы используете агрегаторы вроде OpenRouter, enforcement (принудительное применение) политики может происходить на трех уровнях. Это позволяет гибко управлять рисками для разных моделей.
1. На уровне аккаунта
В настройках приватности можно задать правило для всей группы моделей (например, все модели Anthropic или Google). Это самый простой способ, не требующий изменения кода.
2. На уровне Guardrails
Используйте guardrails для разделения трафика. Например, можно разрешить хранение данных для тестовых моделей, но запретить его для продакшн-запросов с персональными данными.
3. На уровне запроса (API)
Самый надежный способ — явное указание флага в теле запроса. Это работает как логическое ИЛИ с настройками аккаунта: если ZDR включен где-либо, он будет применен. Флаг zdr: true в блоке provider гарантирует маршрутизацию только на совместимые эндпоинты.
import openai
client = openai.OpenAI(
base_url="https://openrouter.ai/api/v1",
api_key="your-api-key"
)
response = client.chat.completions.create(
model="meta-llama/llama-3.3-70b-instruct",
messages=[{"role": "user", "content": "Анализ конфиденциального документа..."}],
provider={
"zdr": True, # Включить Zero Data Retention
"data_collection": "deny" # Запретить сбор данных для обучения
}
)data_collection: "deny" фильтрует провайдеров, которые хранят данные непереходящим образом. Комбинация zdr: true и data_collection: "deny" дает максимальную гарантию приватности.04Проверка совместимости провайдера
Не каждый эндпоинт поддерживает ZDR. Даже если провайдер заявляет о приватности, конкретная модель может иметь иную политику. Перед интеграцией проверьте:
- Точный охват: Покрывает ли ZDR только текст, или также файлы, инструменты и идентификаторы?
- Исключения: Сохраняются ли данные для борьбы с мошенничеством или по требованию закона? Обычно такие эндпоинты не классифицируются как ZDR-совместимые.
- Сторонние сервисы: Если вы используете плагины (например, веб-поиск), они могут сохранять данные по своим правилам. ZDR не распространяется на них.
05Кому подойдёт / что запустится
Политика Zero Data Retention критически важна для:
- Финтех и банки: Обработка транзакционных запросов и клиентских данных.
- Юридические компании: Анализ договоров и конфиденциальных переписок.
- Медицина: Обработка анонимизированных, но чувствительных медицинских записей.
Что запустится: Большинство современных frontier-моделей (Llama 3.3, Claude, GPT-4o) через агрегаторы с поддержкой ZDR-маршрутизации. Для полного контроля над данными (включая отсутствие передачи по сети) рассмотрите self-hosting (локальный запуск) на GPU с достаточным VRAM (например, NVIDIA A100/H100 или потребительские RTX 4090 для квантованных моделей).
Источник: OpenRouter ↗
