Два лица одной модели: доступность и безопасность
Anthropic выпустила обновления линейки Claude 5 — Claude Fable 5.1 и Claude Mythos 5.1. Это одна и та же базовая модель, но с разными слоями защиты. Claude Fable 5.1 (идентификатор claude-fable-5-1) уже доступна всем пользователям через API, Amazon Bedrock, Google Cloud и Microsoft Foundry. Claude Mythos 5.1 остается закрытым для проверенных организаций в рамках проекта Project Glasswing.
Обе версии поддерживают контекстное окно в 1 миллион токенов, генерацию до 128K токенов и всегда активный режим адаптивного мышления (adaptive thinking).
Результаты бенчмарков: научный прорыв
Главное достижение Fable 5.1 — значительный скачок в научных задачах. На бенчмарке Terminal-Bench-Science 0.1 (агентный научный поиск) модель набрала 52.6%, что почти вдвое больше, чем у предшественника Fable 5 (24.7%) и лучше, чем у Opus 5 (29.0%) и GPT-5.6 Sol (22.4%).
Anthropic честно отмечает стандартную ошибку 3.5–4.5 пункта, поэтому важно смотреть на маржу, а не только на ранжирование. Также стоит отметить разрыв в производительности между версиями Fable и Mythos на базовом Terminal-Bench 4.0 (55.8% против 60.9%), который объясняется затратами на вмешательства систем безопасности.
| Модель | Terminal-Bench-Science 0.1 | Terminal-Bench 4.0 | CursorBench 3.2.0 |
|---|---|---|---|
| Claude Fable 5.1 | 52.6% | 55.8% | 73.4% |
| Claude Mythos 5.1 | — | 60.9% | — |
| Claude Opus 5 | 29.0% | — | — |
| Claude Fable 5 | 24.7% | — | — |
| GPT-5.6 Sol | 22.4% | — | — |
Экономика: снижение стоимости кэша на 75%
Базовые цены на ввод ($10/млн токенов) и вывод ($50/млн токенов) остались прежними. Однако Anthropic снизила стоимость чтения из кэша с $1.00 до $0.25 за миллион токенов. Это снижение на 75% (коэффициент 0.025 против 0.1 у других моделей Claude). По оценкам компании, это дает экономию до 25% на типичных нагрузках и до 45% на агентных сценариях с тяжелым контекстом.
Критические изменения в API для разработчиков
Разработчикам агентов нужно учесть три важных изменения, которые могут сломать текущие интеграции:
- Удален принудительный вызов инструментов: Параметр
tool_choiceсо значениямиanyилиtoolтеперь возвращает ошибку 400. Необходимо использоватьautoсо строгим использованием инструментов или структурированными выводами. - Мышление привязано к модели: Fable 5.1 может «читать» мысли предыдущих моделей, но старые модели не видят мысли Fable 5.1. Роутеры и fallback-схемы могут терять способность к рассуждению при переключении.
- Редактирование истории диалога: Вставка или удаление сообщений в середине разговора, а также перестройка массивов
systemилиtoolsтеперь вызывает ошибку. Это касается аккаунтов, созданных после 31 августа 2026 года.
Научные кейсы и регрессии
В области биологии Mythos 5.1 спроектировал белковые связыватели с вероятностью успеха ~50% (против нормы 10-15%), а Fable 5.1 создала карту возвышенности Венеры с разрешением 2-3 км. Кибербезопасность стала строже: разрешено обнаружение уязвимостей, но запрещена разработка эксплойтов, что снизило количество блокировок в Claude Code на 60%.
Anthropic также признала регрессии: параллельный вызов инструментов стал менее стабильным, модель реже использует инструменты для простых ответов и предпочитает переписывать файлы целиком, а не точечно. Все выходные данные теперь содержат статистический водяной знак и C2PA-криптографические метки.
Бенчмарки
| Бенчмарк | Claude Fable 5 | Claude Fable 5.1 | Claude Mythos 5.1 | Claude Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 24.7% | 52.6% | — | 29% | 22.4% |
| Terminal-Bench 4.0 | — | 55.8% | 60.9% | — | — |
Жирным — лучший результат в строке. Источник цифр — официальная публикация.
Источник: MarkTechPost ↗
