Бизнес4 сентября 2026 г., 19:20 МСК🤖 Auto

AI-парадокс Джевонса: полумодели за 1/6 цены флагманов

Объем потребления токенов в AI вырос в 25 раз за год, но пользователи массово переходят на средние модели, обеспечивающие 90% качества флагманов при стоимости в шесть раз ниже.

Баннер новости 6788

Экономика против интеллекта: новая реальность рынка

Рынок искусственного интеллекта переживает фундаментальный сдвиг. Несмотря на гонку вооружений между лидерами вроде Anthropic и OpenAI, бизнес-сектор столкнулся с «ценовым расчетом» (pricing reckoning). По данным инженеров OpenRouter, объем платного потребления токенов увеличился в 25 раз за последний год и удвоился всего за месяц. Это классический парадокс Джевонса: чем дешевле становится доступ к интеллекту, тем больше его потребляется, но бюджеты компаний (как у Uber, потратившей годовой лимит за несколько месяцев) не бесконечны.

Битва на Парето-фронте: кто лидирует?

Ключевым показателем эффективности стала «Парето-фронта» — точка, где соотношение цены и качества оптимально. Здесь царит жесткая конкуренция, и лидерские позиции меняются каждые несколько часов. На сентябрь 2026 года пальму первенства удерживает Meta Muse Spark 1.3 (xhigh), предлагающая балл 61 по Intelligence Index за $0.55 за задачу. Ранее этот титул носил Google Gemini 3.8 Flash, но лишь в течение 3,5 часов.

Сравнение стоимости и качества на тесте Intelligence Index:

Модель Балл (Intelligence Index) Цена за задачу ($) Примечание
Claude Fable 5.1 (Anthropic) 66 $3.69 Лидер по интеллекту, но самый дорогой
GPT 5.6 Sol (OpenAI) 61 $0.43 Высокая эффективность, флагман среднего звена
Meta Muse Spark 1.3 (xhigh) 61 $0.55 Текущий лидер Парето-фронты
Gemini 3.8 Flash (Google) 59 $0.58 90% качества флагмана за 1/6 цены
Kimi K3 (max) (Moonshot) 60 $0.84 Сильный китайский конкурент
GPT 5.6 Luna (OpenAI) 52 $0.05 Самая используемая модель (12 трлн токенов/мес)

Китайские модели и массовое потребление

Самые популярные модели — не самые умные, а самые дешевые. Лидером по объему потребления стал OpenAI GPT 5.6 Luna с показателем 52 балла за $0.05, обработавший почти 12 триллионов токенов за месяц. За ним следует китайская модель Z-Ai GLM 5.3 Flash (11.4 трлн токенов, рост на 1000% за месяц) и Deepseek V4 Flash. Эти модели обеспечивают достаточный уровень интеллекта для массовых задач, вытесняя дорогие флагманы из повседневного использования.

Почему это важно?

Индустрия перестает быть «Диким Западом», где побеждает только абсолютный интеллект. Теперь побеждает эффективность. Разрыв между топовыми моделями (Anthropic Claude Fable, OpenAI GPT 5.6) и средним классом (Google, Meta, китайские стартапы) сокращается в цене, но сохраняется в качестве. Для бизнеса это означает возможность масштабировать AI-интеграции без катастрофического роста затрат, выбирая модели, которые дают 90% результата за 16% стоимости.

Источник: Tom's Hardware ↗