Главная/Блог/Разбор/Claude Sonnet 5: Новый токенизатор,…
Разбор3 мин чтения · 2 июля 2026 г.

Claude Sonnet 5: Новый токенизатор, цена и API-изменения

Анализ релиза Claude Sonnet 5: рост стоимости запросов на 30-40% из-за нового токенизатора, отмена параметров temperature/top_p и новые лимиты контекста.

Claude Sonnet 5: Новый токенизатор, цена и API-изменения

Anthropic выпустила модель Claude Sonnet 5, позиционируя её как решение с производительностью, близкой к флагману Opus 4.8, но по более низкой цене. Однако для практиков, работающих с LLM «в поле», ключевым нововведением стал не только архитектурный апгрейд, но и радикальное изменение экономики запросов. Модель использует новый токенизатор, который существенно меняет расчет стоимости инференса.

01Экономика токенов: новый алгоритм подсчета

Основная проблема при переходе на Sonnet 5 — изменение плотности токенизации. Anthropic официально заявляет, что тот же текстовый ввод генерирует примерно на 30% больше токенов по сравнению с Sonnet 4.6. Это фактическое повышение цены на входные данные, несмотря на сохранение базового прайса за миллион токенов.

Результаты тестирования на реальных документах показывают разную степень «накрутки» в зависимости от языка и типа данных:

Документ / Тип данных Sonnet 4.6 (токены) Sonnet 5 (токены) Коэффициент роста
Всеобщая декларация прав человека (EN) 2,356 3,341 1.42x
Всеобщая декларация прав человека (ES) 3,572 4,747 1.33x
Код Python (sqlite_utils/db.py, 4279 строк) 44,014 56,113 1.28x
Китайский язык (упрощенный) 3,334 3,360 1.01x

Для английского текста и кода стоимость обработки входа возрастает почти в 1.4 раза. Для китайского языка прирост минимален. Это критически важно при оптимизации затрат в высоконагруженных пайплайнах.

💡
Важно для бюджета. Базовая цена $3/млн входных токенов теперь дает реальный эффект $4.2/млн для английского текста. Закладывайте этот коэффициент в калькуляторы стоимости ваших AI-агентов.

02API-изменения и параметры

Разработчикам необходимо обновить клиентские библиотеки. Anthropic убрала ряд стандартных параметров сэмплирования, упростив интерфейс, но ограничив гибкость настройки креативности:

  • Удалено: temperature, top_p, top_k. Эти параметры больше не поддерживаются в запросах к Sonnet 5.
  • Контекст: Оконный размер увеличен до 1,000,000 токенов (1M), максимальный вывод ограничен 128,000 токенами.
  • Инструменты: Поддерживается тот же набор инструментов и платформенных функций, что и в Sonnet 4.6.

По умолчанию включена функция Adaptive Thinking (адаптивное мышление). Если вам нужен быстрый ответ без цепочки рассуждений, необходимо явно отключить этот режим.

terminalpython
# Пример отключения Adaptive Thinking в запросе
response = client.chat.completions.create(
    model="claude-sonnet-5-20260630",
    messages=[...],
    thinking={"type": "disabled"}
)

03Безопасность и сравнение с Opus 4.8

В системной карточке (System Card) указано, что Sonnet 5 значительно менее способен к выполнению кибератак по сравнению с моделью Mythos 5. Уровень защиты и фильтрации схож с Opus 4.7 и Opus 4.8. Это позволяет Anthropic выпустить модель, не нарушая текущих регуляторных ограничений США на распространение наиболее мощных ИИ-моделей.

Фактически, Sonnet 5 занимает промежуточное положение: он ближе к Opus 4.8 по качеству ответов, но имеет более строгие ограничения безопасности, чем старшие флагманы.

⚠️
Предупреждение по совместимости. Старые скрипты, передающие temperature или top_p, будут падать с ошибкой API. Обязательно обновите конфигурацию клиентов до версии, поддерживающей Sonnet 5.

04Прайс-лист и промо-акции

Базовые тарифы остались прежними относительно Sonnet 4.6, но с учетом нового токенизатора реальная стоимость выросла. Действует временная скидка до 31 августа 2026 года.

Параметр Стандартная цена Промо-цена (до 31.08.2026)
Входные токены (Input) $3.00 / 1M $2.00 / 1M
Выходные токены (Output) $15.00 / 1M $10.00 / 1M

При использовании промо-цен и учете коэффициента токенизации (1.4x для английского) эффективная стоимость входа составляет около $2.8/млн токенов, что все еще выгодно по сравнению с Opus-серией.

05Кому подойдёт / что запустится

  • Для энтерпрайза и агентов: Идеально для задач, требующих работы с большими контекстами (до 1M токенов), где важна точность, близкая к Opus, но критична стоимость. Отлично подходит для анализа больших баз кода и юридических документов.
  • Для разработчиков: Требуется пересмотр архитектуры кэширования токенов. Из-за роста количества токенов кэш может быть менее эффективным, если не оптимизировать промпты.
  • Локальный запуск: Модель доступна через API. Локальные форки (например, через llama.cpp или vLLM) появятся позже, но из-за нового токенизатора потребуется обновление бэкенда для корректного подсчета стоимости и длины контекста.
  • Языковая специфика: Если ваш основной язык — китайский, вы получите минимальный прирост стоимости. Для английского и кода готовьтесь к увеличению бюджета на 30-40%.

Источник: Simon Willison ↗