Релиз модели29 сентября 2026 г., 19:49 МСК🤖 Auto

Claude Sonnet 5.5: скорость +30%, цена та же, но есть нюансы

Anthropic выпустила Claude Sonnet 5.5: модель стала умнее, быстрее на 30% и дешевле за задачу, но требует пересмотра промптов из-за включенного по умолчанию режима размышлений.

Баннер новости 8527

Что изменилось в Sonnet 5.5

Claude Sonnet 5.5 — вторая модель в семействе Claude 5.5 после Opus 5.5. Это не просто итерация, а существенный апгрейд: модель работает на 30% быстрее и потребляет меньше токенов на выполнение той же задачи, что снижает итоговый счет до 30%. При этом базовая цена за токен осталась прежней. Модель по умолчанию использует режим adaptive thinking (размышления), что меняет структуру ответа: теперь он может начинаться с блока thinking, а не сразу с текста.

Когда выбирать Sonnet, а когда Opus

Anthropic четко разграничивает сферы применения. Sonnet 5.5 идеален для задач с четким спецификацией и возможностью проверки результата: фикс багов, быстрая итерация фич, генерация документов и спредшитов. Opus 5.5 остается выбором для сложных долгосрочных агентов и задач, требующих глубокого суждения. В Epic Games уже протестировали Sonnet 5.5 на аудите системного дизайна и обзоре потоков данных — модель справилась с качеством, ожидаемым от старшей версии, обрабатывая десятки тысяч строк кода.

Параметр Claude Sonnet 5.5 Claude Opus 5.5
Входной токен $2 / млн $4 / млн
Выходной токен $10 / млн $20 / млн
Кэш-запись (5 мин) $2.50 $5.00
Кэш-запись (1 час) $4.00 $8.00
Кэш-чтение $0.20 $0.20
Контекстное окно 1M токенов (нативно) Информация недостаточна
Макс. вывод 128k (до 300k с beta-флагом) Информация недостаточна

Критические изменения при миграции с Sonnet 5

Прямая замена ID модели claude-sonnet-5 на claude-sonnet-5-5 может сломать существующий код из-за трех ключевых изменений:

  • Thinking по умолчанию: Параметр thinking: {"type": "disabled"} теперь возвращает ошибку 400. Чтобы отключить предварительные размышления, используйте новый параметр between_tools. Он позволяет модели думать только между вызовами инструментов, сохраняя или даже ускоряя время ответа.
  • tool_choice: Значения any и tool для tool_choice больше не поддерживаются. Используйте auto и добавьте флаг strict: true к схеме инструмента.
  • Effort levels: По умолчанию установлен уровень high (в Claude Code — medium). Уровни xhigh и max доступны, но они увеличивают время и стоимость. При использовании between_tools доступны только уровни low, medium и high.

Технические детали и оптимизация

Модель поддерживает контекстное окно в 1 миллион токенов и вывод до 128 000 токенов (до 300 000 через Message Batches API). Важно учитывать, что Sonnet 5.5 использует высококачественный уровень обработки изображений (до 2576 пикселей по длинной стороне). Загрузка изображения 2000×1500 стоит примерно в 2.5 раза дороже, чем в Sonnet 4.6. Если детализация не критична, рекомендуется предварительно уменьшать размер изображений перед отправкой. Минимальный размер промпта для кэширования увеличен до 512 токенов (было 1024 в Sonnet 5).

Источник: Claude ↗