Бизнес5 октября 2026 г., 18:32 МСК🤖 Auto

OpenAI представила систему водяных знаков textGrain для текста

OpenAI запустила опциональное водяное маркирование текста для API и внедряет его в ChatGPT в ЕС, чтобы соответствовать требованиям EU AI Act. Технология textGrain добавляет невидимый сигнал, но имеет ограничения при редактировании.

Баннер новости 8962

Новая технология: textGrain и соответствие EU AI Act

В ответ на требования Европейского акта об ИИ (EU AI Act), обязывающего провайдеров генеративного ИИ делать сгенерированный текст идентифицируемым, OpenAI представила систему textGrain. Эта технология добавляет невидимый статистический сигнал к выбору слов модели, позволяя детекторам определять происхождение текста. Подход OpenAI носит поэтапный характер, учитывая текущие технологические ограничения:

  • API-клиенты: С 5 октября 2026 года пользователи API по всему миру могут опционально включить водяные знаки для выбранных моделей. По умолчанию функция отключена.
  • ChatGPT и Codex в ЕС: В ближайшие недели невидимый водяной знак будет добавлен к тексту, генерируемому для пользователей в Европейском Союзе.
  • Детектор: Доступ к инструменту проверки предоставляется ограниченно — только утвержденным исследователям и экспертным организациям для оценки надежности технологии.

Производительность и ограничения

В своих тестах OpenAI сравнила textGrain с другими подходами, включая SynthID for text, показав сопоставимые или лучшие результаты. Однако детекция сталкивается с серьезными вызовами: коротким текстом и редактированием. Ниже приведены метрики обнаружения водяных знаков в текстах на темы «психология» и «математика» при целевом уровне ложноположительных срабатываний 1%:

Фактор влияния Условие Результат обнаружения
Длина текста (Психология) 200 токенов ~80%
Длина текста (Психология) 400 токенов ~95%
Сложность контента Математика (400 токенов) Значительно ниже (из-за жестких ограничений в выборе слов)
Редактирование Замена 10% слов синонимами Снижение с 92% до 66%
Редактирование Замена 25% слов синонимами Снижение до 17%

Влияние на качество моделей

OpenAI подчеркивает, что внедрение водяных знаков не снижает качество генерации. На бенчмарках для новой флагманской модели Astra различия между текстом с водяным знаком и без него статистически незначимы:

Бенчмарк Без водяного знака С водяным знаком
Artificial Analysis Intelligence Index 49.57 49.76
AutomationBench 34.09% 34.86%
DeepSWE v1.1 72.80% 71.68%
Terminal-Bench 4.0 53.90% 56.06%
GPQA Diamond 94.44% 93.94%

Что водяной знак НЕ делает

Компания четко разграничивает возможности технологии. Водяной знак textGrain:

  • Не измеряет вклад человека (не показывает, сколько текста было отредактировано).
  • Не устанавливает авторство, права собственности или юридическую ответственность.
  • Не идентифицирует пользователя, аккаунт или промпт.
  • Не гарантирует достоверность информации (не проверяет факты).
  • Отсутствие знака не доказывает, что текст написан человеком (он мог быть слишком коротким, переведенным или сгенерирован другой моделью).

Стратегия верификации

OpenAI использует многоуровневый подход к происхождению контента. Помимо textGrain для текста, компания продолжает использовать стандарты Content Credentials (C2PA) для изображений и невидимые водяные знаки SynthID для аудио и изображений. Инструменты верификации для медиафайлов остаются общедоступными через openai.com/verify и Content Provenance API, в то время как детектор текста пока закрыт для широкой публики из-за рисков ложных срабатываний.

Источник: OpenAI ↗