Рекордная стоимость интеллекта
Модель Claude Sonnet 5 (Adaptive Reasoning, Max Effort) от Anthropic заняла 27-е место из 550 протестированных в Intelligence Index v4.1, получив оценку 53 из 162. Это значительно выше среднего показателя по классу (29), однако цена этого интеллекта шокирует разработчиков. Полная оценка модели на бенчмарке Intelligence Index обошлась в $6,015.18.
Ключевая проблема — «разговорчивость» модели. Для прохождения тестов Sonnet 5 генерирует в среднем 300 млн токенов вывода, тогда как средний показатель по классу составляет всего 79 млн. Это приводит к тому, что стоимость одной задачи на Intelligence Index превышает $6,000, что делает модель экономически нецелесообразной для многих сценариев, несмотря на высокий уровень интеллекта.
Ценообразование: дороже Opus 4.8
Несмотря на название «Sonnet» (обычно обозначающее средний сегмент), тарифы этой версии Reasoning-модели находятся на уровне премиум-сегмента. По данным Artificial Analysis, Sonnet 5 оказался дороже даже флагманской Opus 4.8 в реальных задачах из-за огромного расхода токенов.
| Параметр | Claude Sonnet 5 (Adaptive Reasoning) | Среднее по классу | Комментарий |
|---|---|---|---|
| Input Price | $3.00 / 1M токенов | $1.67 / 1M токенов | Дороже среднего |
| Output Price | $15.00 / 1M токенов | $8.70 / 1M токенов | Высокая стоимость генерации |
| Cache Write | $3.75 / 1M токенов | — | Цена записи в кэш |
| Cache Hit | $0.30 / 1M токенов | — | Скидка 90% при попадании в кэш |
| Output Tokens/Task | 300M (среднее) | 79M | Критический фактор стоимости |
Скорость и возможности
Модель демонстрирует высокую скорость генерации: 78.9 токенов в секунду, что выше среднего показателя (75 т/с). Контекстное окно составляет 1 млн токенов (эквивалент ~1500 страниц текста A4). Поддерживается ввод текста и изображений, вывод — только текст. Модель использует механизм адаптивного рассуждения (Adaptive Reasoning), что позволяет ей решать сложные агентные задачи, кодирование и научные рассуждения.
Почему это важно?
Результаты анализа показывают тренд на «интеллектуальную инфляцию»: чем умнее модель в режиме рассуждений, тем больше ресурсов она потребляет. Для бизнеса использование Claude Sonnet 5 в режиме Max Effort оправдано только в узких задачах, где критична точность ответа, а не стоимость. Для массовых задач (агентная работа, базовый код) модель слишком «разговорчива» и дорога по сравнению с альтернативами.
Источник: Artificialanalysis ↗
