Новая технология: textGrain и соответствие EU AI Act
В ответ на требования Европейского акта об ИИ (EU AI Act), обязывающего провайдеров генеративного ИИ делать сгенерированный текст идентифицируемым, OpenAI представила систему textGrain. Эта технология добавляет невидимый статистический сигнал к выбору слов модели, позволяя детекторам определять происхождение текста. Подход OpenAI носит поэтапный характер, учитывая текущие технологические ограничения:
- API-клиенты: С 5 октября 2026 года пользователи API по всему миру могут опционально включить водяные знаки для выбранных моделей. По умолчанию функция отключена.
- ChatGPT и Codex в ЕС: В ближайшие недели невидимый водяной знак будет добавлен к тексту, генерируемому для пользователей в Европейском Союзе.
- Детектор: Доступ к инструменту проверки предоставляется ограниченно — только утвержденным исследователям и экспертным организациям для оценки надежности технологии.
Производительность и ограничения
В своих тестах OpenAI сравнила textGrain с другими подходами, включая SynthID for text, показав сопоставимые или лучшие результаты. Однако детекция сталкивается с серьезными вызовами: коротким текстом и редактированием. Ниже приведены метрики обнаружения водяных знаков в текстах на темы «психология» и «математика» при целевом уровне ложноположительных срабатываний 1%:
| Фактор влияния | Условие | Результат обнаружения |
|---|---|---|
| Длина текста (Психология) | 200 токенов | ~80% |
| Длина текста (Психология) | 400 токенов | ~95% |
| Сложность контента | Математика (400 токенов) | Значительно ниже (из-за жестких ограничений в выборе слов) |
| Редактирование | Замена 10% слов синонимами | Снижение с 92% до 66% |
| Редактирование | Замена 25% слов синонимами | Снижение до 17% |
Влияние на качество моделей
OpenAI подчеркивает, что внедрение водяных знаков не снижает качество генерации. На бенчмарках для новой флагманской модели Astra различия между текстом с водяным знаком и без него статистически незначимы:
| Бенчмарк | Без водяного знака | С водяным знаком |
|---|---|---|
| Artificial Analysis Intelligence Index | 49.57 | 49.76 |
| AutomationBench | 34.09% | 34.86% |
| DeepSWE v1.1 | 72.80% | 71.68% |
| Terminal-Bench 4.0 | 53.90% | 56.06% |
| GPQA Diamond | 94.44% | 93.94% |
Что водяной знак НЕ делает
Компания четко разграничивает возможности технологии. Водяной знак textGrain:
- Не измеряет вклад человека (не показывает, сколько текста было отредактировано).
- Не устанавливает авторство, права собственности или юридическую ответственность.
- Не идентифицирует пользователя, аккаунт или промпт.
- Не гарантирует достоверность информации (не проверяет факты).
- Отсутствие знака не доказывает, что текст написан человеком (он мог быть слишком коротким, переведенным или сгенерирован другой моделью).
Стратегия верификации
OpenAI использует многоуровневый подход к происхождению контента. Помимо textGrain для текста, компания продолжает использовать стандарты Content Credentials (C2PA) для изображений и невидимые водяные знаки SynthID для аудио и изображений. Инструменты верификации для медиафайлов остаются общедоступными через openai.com/verify и Content Provenance API, в то время как детектор текста пока закрыт для широкой публики из-за рисков ложных срабатываний.
Источник: OpenAI ↗
