Релиз модели2 сентября 2026 г., 02:19 МСК🤖 Auto

Anthropic выпустила Claude Fable 5.1: двойной рост точности и падение цен на кэш

Anthropic представила Claude Fable 5.1 и Mythos 5.1: модель показала 52.6% на научном бенчмарке Terminal-Bench-Science, а стоимость чтения из кэша снизилась на 75%.

Баннер новости 6542

Два лица одной модели: доступность и безопасность

Anthropic выпустила обновления линейки Claude 5 — Claude Fable 5.1 и Claude Mythos 5.1. Это одна и та же базовая модель, но с разными слоями защиты. Claude Fable 5.1 (идентификатор claude-fable-5-1) уже доступна всем пользователям через API, Amazon Bedrock, Google Cloud и Microsoft Foundry. Claude Mythos 5.1 остается закрытым для проверенных организаций в рамках проекта Project Glasswing.

Обе версии поддерживают контекстное окно в 1 миллион токенов, генерацию до 128K токенов и всегда активный режим адаптивного мышления (adaptive thinking).

Результаты бенчмарков: научный прорыв

Главное достижение Fable 5.1 — значительный скачок в научных задачах. На бенчмарке Terminal-Bench-Science 0.1 (агентный научный поиск) модель набрала 52.6%, что почти вдвое больше, чем у предшественника Fable 5 (24.7%) и лучше, чем у Opus 5 (29.0%) и GPT-5.6 Sol (22.4%).

Anthropic честно отмечает стандартную ошибку 3.5–4.5 пункта, поэтому важно смотреть на маржу, а не только на ранжирование. Также стоит отметить разрыв в производительности между версиями Fable и Mythos на базовом Terminal-Bench 4.0 (55.8% против 60.9%), который объясняется затратами на вмешательства систем безопасности.

Модель Terminal-Bench-Science 0.1 Terminal-Bench 4.0 CursorBench 3.2.0
Claude Fable 5.1 52.6% 55.8% 73.4%
Claude Mythos 5.1 60.9%
Claude Opus 5 29.0%
Claude Fable 5 24.7%
GPT-5.6 Sol 22.4%

Экономика: снижение стоимости кэша на 75%

Базовые цены на ввод ($10/млн токенов) и вывод ($50/млн токенов) остались прежними. Однако Anthropic снизила стоимость чтения из кэша с $1.00 до $0.25 за миллион токенов. Это снижение на 75% (коэффициент 0.025 против 0.1 у других моделей Claude). По оценкам компании, это дает экономию до 25% на типичных нагрузках и до 45% на агентных сценариях с тяжелым контекстом.

Критические изменения в API для разработчиков

Разработчикам агентов нужно учесть три важных изменения, которые могут сломать текущие интеграции:

  • Удален принудительный вызов инструментов: Параметр tool_choice со значениями any или tool теперь возвращает ошибку 400. Необходимо использовать auto со строгим использованием инструментов или структурированными выводами.
  • Мышление привязано к модели: Fable 5.1 может «читать» мысли предыдущих моделей, но старые модели не видят мысли Fable 5.1. Роутеры и fallback-схемы могут терять способность к рассуждению при переключении.
  • Редактирование истории диалога: Вставка или удаление сообщений в середине разговора, а также перестройка массивов system или tools теперь вызывает ошибку. Это касается аккаунтов, созданных после 31 августа 2026 года.

Научные кейсы и регрессии

В области биологии Mythos 5.1 спроектировал белковые связыватели с вероятностью успеха ~50% (против нормы 10-15%), а Fable 5.1 создала карту возвышенности Венеры с разрешением 2-3 км. Кибербезопасность стала строже: разрешено обнаружение уязвимостей, но запрещена разработка эксплойтов, что снизило количество блокировок в Claude Code на 60%.

Anthropic также признала регрессии: параллельный вызов инструментов стал менее стабильным, модель реже использует инструменты для простых ответов и предпочитает переписывать файлы целиком, а не точечно. Все выходные данные теперь содержат статистический водяной знак и C2PA-криптографические метки.

Бенчмарки

БенчмаркClaude Fable 5Claude Fable 5.1Claude Mythos 5.1Claude Opus 5GPT-5.6 Sol
Terminal-Bench-Science 0.124.7%52.6%29%22.4%
Terminal-Bench 4.055.8%60.9%

Жирным — лучший результат в строке. Источник цифр — официальная публикация.

Источник: MarkTechPost ↗