Возвращение модели и причины блокировки
1 июля 2026 года Anthropic возобновила глобальный доступ к Claude Fable 5 — своей самой мощной модели общего назначения. Ранее, 12 июня, доступ был приостановлен из-за введения экспортных ограничений США, которые требовали верификации национальности пользователей в реальном времени. Anthropic не смогла обеспечить это технически, поэтому отключила модель для всех.
Триггером для вмешательства регуляторов стал отчет исследователей Amazon, обнаруживших метод обхода защитных фильтров Fable 5. В ходе теста модель сгенерировала код эксплуатации уязвимости ПО. Anthropic подчеркивает, что этот метод не уникален: аналогичные результаты были получены с моделями GPT-5.5, Kimi K2.7 и даже более старыми версиями Opus.
Новый механизм безопасности: от отказа к переадресации
Вместо полного отказа в обслуживании Anthropic внедрила улучшенный классификатор безопасности. Он перехватывает запросы, использующие выявленную технику обхода, в 99% случаев. Важно: такие запросы не блокируются окончательно, а переадресуются на Claude Opus 4.8. Пользователь получает уведомление о смене модели, но код API остается неизменным.
Исследователи из CAISI (Министерство торговли США) подтвердили эффективность новых мер, отметив, что защита стала «чрезвычайно сильной», хотя это и приводит к увеличению ложных срабатываний при рутинном программировании.
Сравнение с конкурентами: GLM-5.2 и цены
В период простоя Fable 5 рынок заполнила модель GLM-5.2 от Zhipu AI с открытыми весами. Она использует архитектуру Mixture-of-Experts (750 млрд параметров, 40 млрд активных) и демонстрирует высокую эффективность в задачах кибербезопасности, обогнав Claude Code на бенчмарке Semgrep IDOR (39% F1 против 32%).
Ниже приведено сравнение ключевых характеристик моделей:
| Модель | Разработчик | Доступ | Цена (вход/выход за 1M токенов) | Ключевая метрика |
|---|---|---|---|---|
| Claude Fable 5 | Anthropic | Глобальный | $10 / $50 | AA-Briefcase: 1587 Elo |
| GLM-5.2 | Zhipu AI | Open weights (MIT) | ~$1.40 / ~$4.40 | SWE-bench Pro: 62.1 |
| Claude Opus 4.8 | Anthropic | Глобальный | ~$5 / ~$25 | SWE-bench Pro: 69.2 |
| GPT-5.5 | OpenAI | Глобальный | ~$5 / ~$30 | SWE-bench Pro: 58.6 |
Предлагаемая шкала оценки уязвимостей (Jailbreak Framework)
Anthropic совместно с Amazon, Microsoft и Google разрабатывает стандарт для оценки тяжести обхода защитных механизмов. Шкала базируется на четырех критериях:
- Capability gain: Насколько новые возможности открываются пользователю.
- Breadth of capability gain: Количество различных оффенсивных задач, которые становятся доступными.
- Ease of weaponization: Сколько усилий требуется для превращения техники в атаку.
- Discoverability: Насколько легко найти метод обхода.
Практическое применение и доступность
Claude Fable 5 позиционируется для долгосрочных агентных задач. Примеры использования включают миграцию кодовых баз (Stripe сократила задачу с 2 месяцев до 1 дня для 50 млн строк кода) и финансовый анализ. Модель доступна через API, Claude.ai, Claude Code и Cowork. Для пользователей Pro, Max и Team доступ включен до 7 июля, после чего будет учитываться в лимитах использования.
Бенчмарки
| Бенчмарк | Claude Code | Claude Opus 4.8 | GLM-5.2 | GPT-5.5 |
|---|---|---|---|---|
| SWE-bench Pro | — | 69.2% | 62.1% | 58.6% |
| Terminal-Bench | — | 85% | 81% | — |
| Semgrep IDOR | 32% | — | 39% | — |
Жирным — лучший результат в строке. Источник цифр — официальная публикация.
Источник: MarkTechPost ↗
