Суть исследования: масштаб имеет значение
Сервис по удалению данных из баз данных Incogni опубликовал отчет «Gen AI and LLM Data Privacy Ranking 2026», проанализировав 13 крупнейших генеративных AI-платформ. Исследование оценивает риски для приватности пользователей по трем ключевым параметрам: что происходит с данными после отправки, насколько прозрачны политики конфиденциальности и куда именно передаются персональные данные.
Главный вывод экспертов: чем крупнее платформа, тем выше риск утечки или коммерческого использования данных. Однако есть заметное исключение из этого правила — OpenAI.
Топ-3 самых безопасных AI
Платформы с наименьшим уровнем риска (лучшие оценки) демонстрируют более понятные политики и ограниченный сбор данных:
- Mistral AI (Vibe, formerly Le Chat): Лидер рейтинга. Простые для понимания политики, приватные мобильные приложения, сбор данных только из открытых источников и минимальное количество третьих лиц для передачи данных.
- OpenAI (ChatGPT): Четкая и простая политика конфиденциальности. Процесс отказа от использования данных для обучения моделей (opt-out) интуитивно понятен. Данные могут передаваться для безопасности или маркетинга, но риски контролируются.
- Inflection AI (Pi): Несмотря на сложную политику (особенно для пользователей из ЕС в рамках GDPR) и потенциальную передачу данных партнерам, приложение позиционируется как приватно-ориентированное.
Зона высокого риска: Meta, Google и китайские платформы
На противоположном конце спектра оказались платформы, собирающие максимальное количество данных или имеющие непрозрачные механизмы их использования. Китайская платформа Kimi (Moonshot AI) признана имеющей наибольшие риски в обработке данных, а приложение использует данные для трекинга пользователей. Meta названа самой «жадной до данных» моделью из-за широкой политики, где сложно проверить, используются ли данные из групповых чатов. Google Gemini получил высокие баллы риска из-за «частичной» политики, которая по умолчанию подчиняется общим правилам сбора данных Google.
Сводная таблица результатов
Ниже приведена сводка по ключевым игрокам рынка, отсортированная от наименьшего к наибольшему риску приватности:
| Платформа | Оценка риска | Ключевые особенности обработки данных |
|---|---|---|
| Vibe (Mistral AI) | Низкий | Простая политика, минимум третьих лиц, данные из открытых источников. |
| ChatGPT (OpenAI) | Низкий | Прозрачный opt-out для обучения, данные могут идти на маркетинг/безопасность. |
| Pi (Inflection AI) | Средний | Сложная политика для ЕС, передача данных партнерам, но приватное приложение. |
| Perplexity AI | Средний | Легкий opt-out, но данные могут передаваться аффилированным лицам. |
| Qwen (Alibaba) | Выше среднего | Неясно, используются ли чаты для обучения; передача данных аналитическим сервисам. |
| DeepSeek | Выше среднего | Локальные модели безопаснее, хостинг-версии имеют серьезные риски. Есть опция удаления данных. |
| Z.ai | Выше среднего | Неоднозначность с обучением моделей, политика не детализирована. |
| Claude (Anthropic) | Высокий | По умолчанию не использует данные для обучения, но новая политика (июль 2026) требует opt-out. Публикация агрегированных данных. |
| Grok (xAI) | Высокий | Данные передаются аффилированным лицам. Модель обучается на публичных постах X. |
| Meta AI | Очень высокий | Самая «жадная» к данным модель. Политика слишком широкая, сложно верифицировать использование данных из групповых чатов. |
| Kimi (Moonshot AI) | Критический | Наибольший риск обработки данных. Трекинг пользователей через приложение, сложный отказ от обучения. |
Почему это важно для пользователя
Исследование подчеркивает, что ни одна из платформ не позволяет полностью извлечь данные после их использования для обучения модели, и отозвать согласие задним числом невозможно. Инциденты, такие как случайная индексация чатов Claude, показывают, что риски возникают постоянно. Эксперты рекомендуют выбирать AI с максимально прозрачной политикой (как Vibe или ChatGPT) и критически оценивать то, чем вы делитесь с нейросетями.
Источник: ZDNet AI ↗
