Конец блокировки и новые условия доступа
30 июня 2026 года Anthropic официально сняла экспортные ограничения с модели Claude Fable 5, наложенные правительством США 12 июня. Доступ к модели восстанавливается для всех пользователей глобально с 1 июля 2026 года через платформу Claude, Claude.ai, Claude Code и Claude Cowork.
Важное изменение касается тарифных планов: до 7 июля 2026 года Fable 5 будет включена в лимиты использования для подписчиков Pro, Max, Team и корпоративных планов. Однако этот объем ограничен 50% от еженедельных лимитов. После 7 июля доступ к модели будет предоставляться исключительно через систему usage credits (платные кредиты).
Почему произошла блокировка и как её решили
Инцидент возник после того, как исследователи Amazon обнаружили метод обхода защитных фильтров Fable 5, позволяющий модели выявлять уязвимости ПО и генерировать код для их эксплуатации. Anthropic провела независимое тестирование и пришла к выводу, что эта способность не является уникальной для Fable 5.
Модель Fable 5 не обладает «уникальными офенсивными киберспособностями» уровня Mythos 5. Поведение, вызвавшее тревогу, оказалось пограничным случаем: модель выполняла рутинные задачи оборонительной кибербезопасности, которые были ошибочно заблокированы слишком строгими фильтрами.
Сравнение результатов тестирования уязвимостей
Anthropic опубликовала данные, показывающие, что способность идентифицировать уязвимости и демонстрировать методы их эксплуатации характерна для многих современных моделей, а не только для Fable 5. Ниже приведены результаты тестирования различных моделей на способность выявлять уязвимости и генерировать эксплойты:
| Модель | Выявление уязвимостей | Генерация кода эксплойта |
|---|---|---|
| Claude Fable 5 | Да | Да |
| Claude Opus 4.8 | Да | Да |
| GPT-5.5 | Да | Да |
| Kimi K2.7 | Да | Да |
| Claude Haiku 4.5 | Да | Да |
| Claude Sonnet 4.6 | Да | Да |
Новые фильтры безопасности: цена за надежность
Для устранения уязвимости в системе безопасности Anthropic обучила новый классификатор, который блокирует описанный метод обхода в более чем 99% случаев. Однако эта мера имеет обратную сторону: новый фильтр чаще реагирует на легитимные запросы в рамках рутинного кодирования и отладки (false positives).
Теперь, если запрос к Fable 5 будет заблокирован новым классификатором, пользователь получит уведомление, а запрос будет автоматически перенаправлен в модель Claude Opus 4.8. Anthropic признает, что это снижает удобство использования, но объясняет это необходимостью «запаса прочности» (safety margin) для предотвращения потенциально опасных сценариев.
Дальнейшие шаги: Glasswing и стандарты индустрии
Anthropic продолжает сотрудничество с правительством США в рамках программы Project Glasswing. Доступ к более мощной модели Mythos 5 (которая имеет меньше ограничений, но предназначена только для оборонительной кибербезопасности) восстановлен для ограниченного круга американских организаций с 26 июня. Компания также анонсировала разработку совместно с Amazon, Microsoft и Google общего стандарта для оценки серьезности «джейлбрейков» (обходов безопасности) в индустрии.
Источник: Anthropic ↗
