В мире искусственного интеллекта, где гонка вооружений между крупными языковыми моделями (LLM) кажется бесконечной, каждый новый релиз несет в себе не просто технические улучшения, а сдвиг парадигмы. 28 сентября 2026 года компания Anthropic официально представила Claude Sonnet 5.5. Это вторая модель в семействе Claude 5.5, ставшая логичным продолжением после выхода Claude Opus 5.5. Однако, в отличие от своего старшего брата, позиционируемого как инструмент для сложнейших исследовательских задач, Sonnet 5.5 заявлена как оптимизированное решение для повседневных, хорошо ограниченных задач: исправление багов, создание polished-документов, слайдов и таблиц. Но главное — это не просто «быстрее и дешевле». Это модель, которая впервые показала способность к автономному прохождению сложных тестов на использование операционной системы, включая легендарную игру Pokémon Red, исключительно на основе скриншотов.
Для разработчиков, инженеров по данным и бизнес-аналитиков вопрос «а можно ли это развернуть?» стоит всегда на первом месте. Ответ — да, модель уже доступна. Она жива на платформе Claude под идентификатором claude-sonnet-5-5, а также интегрирована в основные облачные провайдеры: AWS, Google Cloud и Microsoft Azure. Однако есть важный нюанс: это модель с закрытыми весами (closed-weights). Это означает, что локальный запуск на собственных серверах или видеокартах невозможен. Доступ осуществляется исключительно через API, что, с одной стороны, ограничивает гибкость для энтузиастов, но с другой — гарантирует стабильность и безопасность инфраструктуры для корпоративных клиентов.
01Что изменилось по сравнению с Sonnet 5?
Anthropic не просто выпустила итерацию, а провела значительную работу над архитектурой и эффективностью. В официальном отчете выделены четыре ключевых улучшения, которые отличают Sonnet 5.5 от предшественника Sonnet 5. Во-первых, скорость. Генерация вывода стала на 30% быстрее, что делает Sonnet 5.5 самой быстрой моделью в линейке Sonnet на сегодняшний день. Это критически важно для агентных систем, где задержка в ответе может сорвать весь workflow.
Во-вторых, стоимость задачи. Несмотря на то, что базовые тарифы остались прежними, стоимость одной задачи снизилась до 30%. Это достигается за счет того, что модель требует меньше токенов на ввод и меньше вызовов инструментов (tool calls). В-третьих, качество текста. Пользователи отмечают более ясный и структурированный стиль письма, называя модель лучшим партнером для совместной работы над текстами. И, наконец, в-четвертых, зрение и долгосрочное планирование. Sonnet 5.5 стала первой моделью Sonnet, которая смогла пройти игру Pokémon Red, используя только скриншоты, что демонстрирует прорыв в понимании визуального контекста и долгосрочных стратегий.
Технические спецификации также впечатляют. Модель поддерживает контекстное окно в 1 миллион токенов, что позволяет загружать огромные базы кода или документы. Максимальный объем вывода составляет 128 тысяч токенов. Базовые знания модели актуальны по июнь 2026 года. По умолчанию включена функция «Adaptive thinking» (адаптивное мышление), которая позволяет модели самостоятельно решать, когда нужно задуматься над ответом. Управление глубиной рассуждений осуществляется через 5 уровней усилий: low, medium, high, xhigh и max.
02Бенчмарки: Цифры, которые говорят сами за себя
Чтобы понять реальную мощность Sonnet 5.5, нужно взглянуть на результаты тестирования. Все приведенные ниже цифры сообщены самим разработчиком (vendor-reported) и опубликованы в официальном посте о запуске. Методология подробно описана в Sonnet 5.5 System Card.
На тесте Terminal-Bench 4.0, который оценивает способность модели выполнять задачи в командной строке, Sonnet 5.5 показала результат 70.6%. Для сравнения, предыдущая версия Sonnet 5 показала лишь 10.3%, а флагманская Opus 5.5 (на уровне усилий Xhigh) — 66.4%. Это колоссальный скачок, который ставит Sonnet 5.5 в один ряд с премиальными моделями в области агентного программирования.

На CursorBench 4.0 (тест на использование IDE Cursor) результат составил 55.5%, что всего на 2 пункта уступает Opus 5.5 (57.8%). На FrontierCode 1.1 модель набрала 52.1% на уровне Xhigh и 46.2% на Max. Для контекста: GPT-6 Sol показала 49.3%. Интересно, что результат на уровне Max оказался ниже, чем на Xhigh. Anthropic объясняет это тем, что на уровне Max модель чаще запускала многоагентный код-ревью, что иногда приводило к таймаутам или правкам вне области видимости, за что FrontierCode наказывает штрафными баллами.
На тесте GDPval-AA v2.1 (оценка экономического воздействия) Sonnet 5.5 набрала 1844 балла, что практически идентично результату Opus 5.5 (1846) и значительно выше Sonnet 5 (1449). На OSWorld 2.1 (тест на использование операционной системы) результат составил 80.1%, что близко к Opus 5.5 (81.8%). И, наконец, на Humanity’s Last Exam с использованием инструментов модель показала 64.5%, улучшив показатель Sonnet 5 (54.9%).
03Ценообразование и эффективность: Экономия без снижения цен
Одним из самых сильных аргументов в пользу Sonnet 5.5 является ее экономическая эффективность. Базовое ценообразование осталось неизменным по сравнению с Sonnet 5: $2 за миллион входных токенов и $10 за миллион выходных токенов. Чтение из кэша стоит $0.20 за миллион, а запись в кэш — $2.50 за миллион. Это вдвое дешевле, чем Opus 5.5 ($4/$20). Однако экономия достигается не за счет снижения ценника, а за счет эффективности использования токенов.
Данные от клиентов подтверждают эту эффективность. Компания Balyasny Asset Management измерила, что Sonnet 5.5 требует около 121 тысячи токенов на ответ, в то время как Sonnet 5 требовал 497 тысяч. Компания Base44 отчетила, что для сборки приложения требуется 3.6 итерации с Sonnet 5.5, тогда как Opus 5 требовал 7.7 итераций. Zendesk сообщил, что обработка тикетов стала на 20% быстрее.
Важно отметить различия в настройках по умолчанию. В Claude Code и приложениях Claude по умолчанию установлен уровень усилий Medium. В то же время, в Claude Platform API по умолчанию установлен уровень High. Это позволяет пользователям гибко настраивать баланс между скоростью и глубиной анализа в зависимости от своих задач.
thinking. В Sonnet 5.5 поле thinking: disabled больше не поддерживается. Вместо него нужно использовать thinking: {"type": "between_tools"} для уровней low, medium и high. Игнорирование этого изменения приведет к ошибке 400 Invalid Request Error.04Сравнение с конкурентами
Чтобы оценить место Sonnet 5.5 на рынке, давайте сравним ее с основными конкурентами: GPT-6 Sol от OpenAI, Gemini 3.1 Pro Preview от Google и Claude Opus 5.5 от Anthropic.

| Характеристика | Claude Sonnet 5.5 | GPT-6 Sol | Gemini 3.1 Pro Preview | Claude Opus 5.5 |
|---|---|---|---|---|
| Разработчик | Anthropic | OpenAI | Anthropic | |
| Цена за 1M токенов (ввод/вывод) | $2 / $10 | $2 / $10 | $2 / $12 | $4 / $20 |
| Контекстное окно | 1M токенов | 1,050,000 токенов | 1,048,576 токенов | 1M токенов |
| Макс. вывод | 128K токенов | 128K токенов | 65,536 токенов | 128K токенов |
| Контроль рассуждений | Adaptive thinking, 5 уровней | 6 уровней (none to max) | Thinking supported | Adaptive thinking (always on) |
| Входные данные | Текст, изображение | Текст, изображение | Текст, изображение, видео, аудио, PDF | Текст, изображение |
| FrontierCode 1.1 | 52.1% (Xhigh) | 49.3% | Не сообщено | 54.4% |
| GDPval-AA v2.1 | 1844 | 1487 | Не сообщено | 1846 |
| Chartography (без инструментов) | 61.6% | 53.6% | Не сообщено | 64.4% |
| Стадия релиза | Generally availableGenerally available | Preview | Generally available | |
| Открытые веса | Нет | Нет | Нет | Нет |
Как видно из таблицы, Sonnet 5.5 демонстрирует выдающиеся результаты на тестах FrontierCode и GDPval-AA, конкурируя с Opus 5.5 и значительно опережая GPT-6 Sol. При этом она сохраняет ту же цену, что и GPT-6 Sol, но предлагает более широкий контекст и больший объем вывода, чем Gemini 3.1 Pro Preview.
05Интерактивный разбор: Бенчмарки, уровни усилий и стоимость
Anthropic предоставила интерактивный инструмент для понимания работы Sonnet 5.5. Давайте разберем ключевые аспекты.
Уровни усилий (Effort Levels)
Модель предлагает 5 уровней усилий для управления глубиной рассуждений:
- Low (between_tools): Самый быстрый режим, подходящий для простых задач.
- Medium: Баланс между скоростью и качеством. Рекомендуется для большинства рабочих нагрузок.
- High: По умолчанию в Claude Platform API. Рекомендуется для сложных агентных задач.
- Xhigh: Глубокое рассуждение, используется в бенчмарках.
- Max: Максимальная глубина, но может приводить к таймаутам в некоторых сценариях.
Стоимость задачи
Давайте рассчитаем экономию. При базовых ценах ($2 за ввод, $10 за вывод за 1M токенов):
- Входные токены на задачу: 120K
- Выходные токены на задачу (Sonnet 5): 40K
- Снижение токенов на Sonnet 5.5: 30%

Стоимость одной задачи на Sonnet 5: $0.640. Стоимость одной задачи на Sonnet 5.5: $0.448. При 10,000 задач в месяц вы экономите $1,920. Важно помнить, что эта экономия достигается за счет меньшего количества токенов и вызовов инструментов, а не за счет снижения ценника.
Миграция с Sonnet 5
При переходе с Sonnet 5 на Sonnet 5.5 необходимо учесть изменения в API. Например, если вы использовали thinking: {"type": "disabled"}, теперь это вызовет ошибку. Вместо этого используйте thinking: {"type": "between_tools"} для уровней low, medium и high. Также обратите внимание, что поле model_id остается прежним, но поведение модели изменилось.
06Что это значит на практике
Выпуск Claude Sonnet 5.5 знаменует собой новый этап в развитии агентного ИИ. Модель демонстрирует, что высокая производительность не обязательно должна сопровождаться высокой стоимостью. Для разработчиков это означает возможность запускать более сложные агентные задачи, такие как автономное исправление багов и генерация кода, с меньшими затратами ресурсов. Для бизнеса это возможность автоматизировать рутинные процессы, такие как обработка тикетов и создание документов, с высокой точностью и скоростью.
Особенно впечатляет способность Sonnet 5.5 работать с визуальным контекстом и долгосрочными задачами. Прохождение Pokémon Red на основе скриншотов — это не просто трюк, а демонстрация того, что модель может понимать сложные интерфейсы и принимать решения на основе визуальной информации. Это открывает новые возможности для создания ИИ-ассистентов, которые могут работать с любыми приложениями, требующими визуального взаимодействия.
Однако важно помнить, что Sonnet 5.5 — это не замена Opus 5.5 для самых сложных, открытых задач. Opus 5.5 остается сильнее в сложных, многошаговых рассуждениях. Sonnet 5.5 — это оптимизированное решение для задач, где важна скорость, стоимость и достаточная точность. Для таких задач, как исправление багов, создание документов и работа с кодом, Sonnet 5.5 может быть даже предпочтительнее Opus 5.5 из-за своей эффективности.
В заключение, Claude Sonnet 5.5 — это мощный инструмент, который расширяет границы возможного в области агентного ИИ. Ее доступность через основные облачные платформы и конкурентоспособная цена делают ее привлекательным выбором для широкого круга пользователей. Если вы ищете модель, которая сочетает в себе скорость, стоимость и высокую производительность, Sonnet 5.5 — отличный кандидат для тестирования и внедрения в ваши проекты.
Для тех, кто хочет глубже погрузиться в тему, рекомендуется ознакомиться с официальным объявлением, руководством по миграции и системной картой Sonnet 5.5. Все эти материалы доступны на сайте Anthropic. Также не забудьте подписаться на обновления в социальных сетях и на нашем Reddit-сообществе, чтобы быть в курсе последних новостей из мира ИИ.
Источник: MarkTechPost ↗
