Сроки и масштаб внедрения
Компания Anthropic официально подтвердила, что новые версии модели Claude будут соответствовать требованиям Европейского союза по идентификации контента, сгенерированного ИИ. Согласно закону EU AI Act, провайдеры обязаны внедрить меры идентифицируемости к 2 августа 2026 года. Anthropic уточнила, что маркировка будет применяться к выводам поддерживаемых моделей по всему миру, а не только в ЕС, с целью дополнения существующих моделей Claude в срок до 2 декабря 2026 года.
Технология маркировки текста: статистическое смещение
В отличие от стеганографии, используемой в изображениях, для текста Anthropic применяет метод смещения выбора токенов. При генерации текста модель намеренно выбирает слова или их части, создающие специфический статистический паттерн. Этот паттерн сохраняется даже при копировании и легкой правке текста. Важно отметить, что фрагменты текста короче 200 токенов исключены из маркировки, так как они не содержат достаточного объема данных для надежной идентификации. Качество и смысл сгенерированного текста не страдают от этого процесса.
Маркировка изображений: стандарт C2PA
Для графического контента (форматы SVG, PNG, JPG) Anthropic использует стандарт C2PA (Coalition for Content Provenance and Authenticity). В файлы встраивается цифровой сертификат происхождения, который автоматически аннулируется при любом изменении изображения. Примечательно, что в текущем плане Anthropic не упоминает визуальные водяные знаки для изображений, хотя они рекомендованы Кодексом практики. Ожидается, что эта функция будет добавлена позже, чтобы предотвратить обход отслеживания простым копированием контента.
Сравнение подходов к маркировке
| Параметр | Текст (Claude) | Изображения (Claude) |
|---|---|---|
| Метод маркировки | Статистический паттерн токенов | Цифровой сертификат C2PA |
| Устойчивость к правкам | Высокая (сохраняется при копировании) | Высокая (сертификат аннулируется при изменении) |
| Визуальное проявление | Отсутствует (невидимо для пользователя) | Отсутствует (метаданные скрыты) |
| Исключения | Фрагменты < 200 токенов | Информация недостаточна |
Инструменты детекции и ложные срабатывания
Anthropic обязана предоставить инструменты для обнаружения водяных знаков, детали которых будут опубликованы в будущей технической документации. Компания предупреждает о возможных ложных срабатываниях: прямые цитаты, включенные в ответ модели, могут ошибочно маркироваться как сгенерированные ИИ. Отсутствие водяного знака также не является гарантией того, что контент не был создан или обработан ИИ. Anthropic следует за примером OpenAI и Google, которые уже опубликовали свои руководства по compliance, но делает это с акцентом на глобальное применение стандартов.
Источник: Tom's Hardware ↗
