Ключевые изменения: цена, конфиденциальность и стиль
Anthropic представила Claude Fable 5.1, позиционируя её как лучшую модель для кодинга, анализа данных, работы с компьютером (computer use) и сложных агентных сценариев. Главное нововведение — не только улучшение качества, но и изменение бизнес-модели. Стоимость чтения кэша снижена с $1 до $0,25 за миллион токенов, что делает типичные сессии в Claude Code дешевле на 38%, а работу сложных агентов — до 45%.
Важным шагом для корпоративного сектора стала опция zero data retention (полное отсутствие хранения данных). Ранее Anthropic требовала хранить данные 30 дней, что отпугивало многие компании. Теперь «eligible customers» могут хранить данные самостоятельно. Параллельно Anthropic снизила количество ложных срабатываний фильтров безопасности: в биологии — на 85%, в кибербезопасности (для пользователей Claude Code) — на 60%.
Бенчмарки: рост в науке, нюансы в коде
Сравнение Fable 5.1 с предыдущими флагманами (Opus 5, Mythos 5) показывает смешанные результаты. Значительный скачок наблюдается в научных задачах, тогда как в некоторых кодовых тестах модель демонстрирует регрессию или стагнацию из-за чрезмерной «проактивности» при высоких уровнях усилий.
| Бенчмарк | Результат Fable 5.1 | Предыдущий лидер (Opus 5 / Mythos 5) | Комментарий |
|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | Значительный рост в научных исследованиях |
| Humanity’s Last Exam | 60.9% / 65.0% (с инструментами) | 57.8% / 63.8% | Умеренное улучшение |
| CritPT-Corrected | 88.4% | 85.5% | Улучшение качества ответов |
| CursorBench 3.2 | 73.4% | 70.5% (Fable 5) | Рост при существенно меньшей стоимости |
| FrontierSWE v2 | 0.57 | 0.52 (Opus 5) | Улучшение в программной инженерии |
| FrontierCode 1.1 Extended | Хуже при высоком effort | — | Модель делает лишние правки, что снижает оценку |
Пользовательский опыт и сравнение с конкурентами
Пользователи отмечают, что Fable 5.1 стала более «человечной» в общении, реже использует клишированные фразы («claudeisms») и охотнее признает ошибки. Модель активно предлагает дополнительные действия, если задан высокий уровень усилий, что делает её полезной для автоматизации, но требует тщательного контроля.
В сравнении с GPT-6 Astra (от OpenAI), обе модели считаются превосходными. Автор обзора рекомендует стратегию «dual wielding» (двойного использования) для сложных задач, так как ответы моделей часто дополняют друг друга. Однако прямое сравнение затруднено из-за разницы в подходах к безопасности и хранению данных.
Ценообразование и доступность
На платформе OpenRouter Claude Fable 5.1 доступна по цене $10.00 за миллион входных токенов и $50.00 за миллион выходных токенов. Несмотря на то, что базовая цена не изменилась по сравнению с Fable 5, эффективная стоимость снизилась за счет дешевого кэша. Это создает стимул для массового перехода корпоративных клиентов, которые ранее избегали Claude из-за политики хранения данных и агрессивных фильтров.
Бенчмарки
| Бенчмарк | Claude Fable 5.1 | Fable 5 | Opus 5 | Sol |
|---|---|---|---|---|
| FrontierSWE v2 | 57% | 48% | 52% | 32% |
| CursorBench 3.2 | 73.4% | 70.5% | — | 67.2% |
Жирным — лучший результат в строке. Источник цифр — официальная публикация.
Источник: LessWrong ↗
