Релиз модели2 июля 2026 г., 00:16 МСК🤖 Auto

Anthropic вернул Claude Fable 5: новые фильтры, цены и сравнение с GLM-5.2

После приостановки из-за экспортных ограничений США Anthropic вернула флагманскую модель Fable 5. Компания внедрила новый классификатор безопасности, блокирующий 99% обходов, и предложила отраслевую шкалу оценки уязвимостей.

Баннер новости 2770

Возвращение модели и причины блокировки

1 июля 2026 года Anthropic возобновила глобальный доступ к Claude Fable 5 — своей самой мощной модели общего назначения. Ранее, 12 июня, доступ был приостановлен из-за введения экспортных ограничений США, которые требовали верификации национальности пользователей в реальном времени. Anthropic не смогла обеспечить это технически, поэтому отключила модель для всех.

Триггером для вмешательства регуляторов стал отчет исследователей Amazon, обнаруживших метод обхода защитных фильтров Fable 5. В ходе теста модель сгенерировала код эксплуатации уязвимости ПО. Anthropic подчеркивает, что этот метод не уникален: аналогичные результаты были получены с моделями GPT-5.5, Kimi K2.7 и даже более старыми версиями Opus.

Новый механизм безопасности: от отказа к переадресации

Вместо полного отказа в обслуживании Anthropic внедрила улучшенный классификатор безопасности. Он перехватывает запросы, использующие выявленную технику обхода, в 99% случаев. Важно: такие запросы не блокируются окончательно, а переадресуются на Claude Opus 4.8. Пользователь получает уведомление о смене модели, но код API остается неизменным.

Исследователи из CAISI (Министерство торговли США) подтвердили эффективность новых мер, отметив, что защита стала «чрезвычайно сильной», хотя это и приводит к увеличению ложных срабатываний при рутинном программировании.

Сравнение с конкурентами: GLM-5.2 и цены

В период простоя Fable 5 рынок заполнила модель GLM-5.2 от Zhipu AI с открытыми весами. Она использует архитектуру Mixture-of-Experts (750 млрд параметров, 40 млрд активных) и демонстрирует высокую эффективность в задачах кибербезопасности, обогнав Claude Code на бенчмарке Semgrep IDOR (39% F1 против 32%).

Ниже приведено сравнение ключевых характеристик моделей:

Модель Разработчик Доступ Цена (вход/выход за 1M токенов) Ключевая метрика
Claude Fable 5 Anthropic Глобальный $10 / $50 AA-Briefcase: 1587 Elo
GLM-5.2 Zhipu AI Open weights (MIT) ~$1.40 / ~$4.40 SWE-bench Pro: 62.1
Claude Opus 4.8 Anthropic Глобальный ~$5 / ~$25 SWE-bench Pro: 69.2
GPT-5.5 OpenAI Глобальный ~$5 / ~$30 SWE-bench Pro: 58.6

Предлагаемая шкала оценки уязвимостей (Jailbreak Framework)

Anthropic совместно с Amazon, Microsoft и Google разрабатывает стандарт для оценки тяжести обхода защитных механизмов. Шкала базируется на четырех критериях:

  • Capability gain: Насколько новые возможности открываются пользователю.
  • Breadth of capability gain: Количество различных оффенсивных задач, которые становятся доступными.
  • Ease of weaponization: Сколько усилий требуется для превращения техники в атаку.
  • Discoverability: Насколько легко найти метод обхода.

Практическое применение и доступность

Claude Fable 5 позиционируется для долгосрочных агентных задач. Примеры использования включают миграцию кодовых баз (Stripe сократила задачу с 2 месяцев до 1 дня для 50 млн строк кода) и финансовый анализ. Модель доступна через API, Claude.ai, Claude Code и Cowork. Для пользователей Pro, Max и Team доступ включен до 7 июля, после чего будет учитываться в лимитах использования.

Бенчмарки

БенчмаркClaude CodeClaude Opus 4.8GLM-5.2GPT-5.5
SWE-bench Pro69.2%62.1%58.6%
Terminal-Bench85%81%
Semgrep IDOR32%39%

Жирным — лучший результат в строке. Источник цифр — официальная публикация.

Источник: MarkTechPost ↗