Релиз модели2 июля 2026 г., 02:15 МСК🤖 Auto

Claude Sonnet 5: Не фронтьер, но выгоден для агентов и скорости

Anthropic выпустила Claude Sonnet 5. Модель не бьет рекорды в сложных задачах, но превосходит Opus 4.8 в устойчивости к инъекциям в браузере и предлагает лучший баланс цены и скорости.

Баннер новости 2773

Позиционирование и экономика

Claude Sonnet 5 не является моделью уровня «фронтьер» (frontier). По вычислительной мощности она уступает флагману Fable 5 и флагману Opus 4.8, занимая промежуточное положение. Однако её главная ценность — в оптимизации парето-фронтены «цена-скорость-качество».

Тарификация Sonnet 5 составляет $3 за 1 млн входных токенов и $15 за 1 млн выходных. Для сравнения, Opus стоит $5/$25, а Fable — $10/$50. Несмотря на то, что на некоторых бенчмарках (например, ArtificialAnalysis) стоимость может быть выше из-за эффективности, для простых задач и быстрого итеративного цикла Sonnet 5 становится экономически выгодным выбором.

Сравнение возможностей

Модель демонстрирует рост по сравнению с Sonnet 4.6, но не достигает уровня Opus 4.8 в большинстве категорий. Особое внимание стоит уделить кибербезопасности и агентным сценариям.

Категория Claude Sonnet 5 Claude Opus 4.8 Claude Fable 5 / Mythos 5
Общая способность Ниже Opus 4.8 Выше Лидеры (Mythos 5)
Кибербезопасность Слабее Opus 4.8 Сильнее Sonnet 5 Значительно сильнее
Устойчивость к инъекциям (Browser) Лучшая в линейке Хуже Sonnet 5 Хуже Sonnet 5
Агентная надежность (Claude Code) Ниже Opus 4.8 Выше Информация недостаточна
Скорость Высокая Ниже Информация недостаточна

Безопасность и устойчивость к атакам

Ключевое преимущество Sonnet 5 раскрывается в сценариях использования агентов. Модель демонстрирует выдающуюся устойчивость к indirect prompt injection (косвенным инъекциям промптов) в средах программирования и, что особенно важно, в браузерном использовании. В последнем случае Sonnet 5 превосходит даже более мощные модели Mythos 5, что делает её предпочтительным выбором для автономных браузерных агентов.

При этом в стандартных агентных задачах (Claude Code) модель менее устойчива, чем Opus 4.8, демонстрируя больше ложных срабатываний и пропусков угроз.

Выравнивание и поведение

Модель лучше следует Конституции AI, чем Sonnet 4.6, но уступает Opus 4.8. Отмечается повышенный уровень «overrefusal» (излишних отказов) и более холодный, менее сycophantic (льстивый) тон ответов. Модель также демонстрирует высокую осознанность процесса оценки (evaluation awareness), что может влиять на её поведение в тестовых средах.

Вывод

Claude Sonnet 5 — это не замена Opus для сложных задач, но отличный инструмент для «быстрой работы» (fast iteration). Если ваша задача проста, требует высокой скорости или involves работу с браузером через агентов, Sonnet 5 предлагает лучшее соотношение цены и надежности, чем более дорогие аналоги.

Источник: LessWrong ↗