Релиз модели2 сентября 2026 г., 13:50 МСК🤖 Auto

Anthropic Fable 5.1: Новый гайд по промптингу и оптимизации затрат

Anthropic выпустила официальное руководство по эффективному использованию Claude Fable 5.1. Документ раскрывает тонкости управления уровнем усилий (effort), параллельных вызовов инструментов и работы с историей диалога для снижения задержек и стоимос

Баннер новости 6584

Управление уровнем усилий (Effort) и экономия

В Claude Fable 5.1 параметр effort стал ключевым рычагом для балансировки между интеллектом, задержкой и стоимостью. Модель предлагает пять уровней: low, medium, high (по умолчанию), xhigh и max. Важно отметить, что названия уровней не являются кросс-модельными: medium в Fable 5.1 сопоставимо по качеству с high в Fable 5, но дешевле. На уровне low модель часто превосходит Claude Opus и Sonnet по соотношению цена/качество, хотя требует более частого использования инструментов поиска.

Параллельные вызовы инструментов в агентах

В сценариях с кодингом и использованием компьютера (computer-use) модель может выдавать независимые вызовы инструментов по одному, что увеличивает время выполнения и стоимость токенов. Anthropic рекомендует использовать turn-scoped system messages (бета-версия с заголовком mid-conversation-system-clear-at-2026-08-21) для принудительного батчинга. Пример промпта:

"First privately list what you need next; then request every item that doesn't depend on another's result in this one response."

Этот метод позволяет модели выполнять параллельные запросы, экономя раунды обмена данными.

Прозрачность работы модели (Progress Updates)

По умолчанию блоки размышлений (thinking) скрыты от пользователя. В Fable 5.1 модель реже пишет промежуточные отчеты, что может создавать ощущение «зависания» агента. Для решения проблемы:

  • Установите thinking.display: "updates" (бета, заголовок thinking-display-updates-2026-08-18), чтобы отображать статусные строки.
  • Добавьте в системный промпт инструкцию: "Before you start, say in a line what you're about to do; brief updates while you work help the user follow along."

Технические ограничения и баги

Документация выделяет ряд специфических проблем, требующих обхода:

  • Кэширование промптов: История диалога должна быть append-only. Редактирование предыдущих сообщений сбрасывает кэш и инвалидирует блоки размышлений.
  • Длинные ответы: При уровнях xhigh и max модель может долго думать перед генерацией. Необходимо увеличивать max_tokens.
  • Визуализация: Для работы с графиками и плотными изображениями дайте модели инструменты для кропа и зума, иначе она упустит детали.

Сводная таблица рекомендаций

Проблема Решение / Настройка
Высокая задержка/стоимость Тестирование уровней low и medium; батчинг вызовов инструментов
Отсутствие обратной связи от агента thinking.display: "updates"; промпт для промежуточных отчетов
Одиночные вызовы инструментов в циклах Turn-scoped system message с инструкцией по параллельному запросу
Сброс кэша промптов Использовать только append-only историю; не удалять старые сообщения
Потеря деталей в изображениях Предоставить инструменты crop/zoom

Источник: Claude ↗