Главная/Блог/Гайд/Ценовая война LLM: GPT-6 Luna, Opus 5.5…
Гайд4 мин чтения · 23 сентября 2026 г.

Ценовая война LLM: GPT-6 Luna, Opus 5.5 и новые тарифы

OpenAI и Anthropic обрушили цены на флагманские модели. GPT-6 Luna стала самой дешевой умной моделью, а Opus 5.5 оптимизировал кэш. Разбор тарифов и производительности.

Ценовая война LLM: GPT-6 Luna, Opus 5.5 и новые тарифы

Рынок больших языковых моделей (LLM) переживает момент радикального удешевления. 22 сентября 2026 года Anthropic выпустила Claude Opus 5.5, а OpenAI — GPT-6 Sol и GPT-6 Luna. Ключевая новость: новые модели стоят вдвое дешевле своих предшественников из линейки GPT-5.6, что запускает новую фазу ценовой войны. Для практиков это означает возможность использовать более мощные модели для агентов и обработки данных при том же бюджете.

01Тарифная политика: кто дешевле?

OpenAI позиционирует GPT-6 Luna как идеальную модель для приложений (app-building). При цене $0.10 за входной токен и $0.50 за выходной, она бьет рекорды доступности, уступая по цене только устаревшим "Nano"-моделям. GPT-6 Sol занимает нишу среднего сегмента, став дешевле предыдущего поколения Sol.

Anthropic также снизила цены на Claude Opus 5.5 на 20% по сравнению с Opus 5.0. Важно отметить снижение стоимости чтения кэша (cache reads) на 60%, что критично для длинных сессий и агентов, где до 90% токенов обрабатываются по сниженной ставке.

Модель Input ($/M) Cached Input ($/M) Output ($/M)
GPT-6 Luna $0.10 $0.01 $0.50
GPT-6 Sol $2.00 $0.20 $10.00
Grok 4.7 $2.00 $0.50 $6.00
Claude Opus 5.5 $4.00 $0.20 $20.00
Claude Fable 5.1 $10.00 $0.25 $50.00
💡
Экономия на кэше. Снижение цены кэшированного ввода для Opus 5.5 до $0.20/M делает его конкурентоспособным для длинных контекстов. Если ваш пайплайн многократно переиспользует одни и те же системные промпты или документы, реальная стоимость запроса может быть в разы ниже заявленной.

02Производительность и стиль общения

Claude Opus 5.5 получил улучшения в коммуникации, став более четким и эффективным по токенам. Он позиционируется как замена Fable 5.1 по интеллекту, но дешевле. Однако тесты на генерацию SVG (тест "пеликан на велосипеде") выявили проблему с режимом "Max" (максимальное размышление).

В режиме max Opus 5.5 "зациклился" на анализе анатомии пеликана и превысил лимит в 128 000 выходных токенов, не вернув результат. Это заняло ~20 минут и стоило $2.56 за попытку. Режим max для Opus 5.5 пока не рекомендуется к использованию в продакшене из-за риска бесконечного рефлексивного цикла.

GPT-6 Luna демонстрирует высокую скорость и компетентность в задачах генерации SQL, HTML и JS. В тестах визуализации (SVG) модели семейства GPT-6 используют более приглушенные цвета по сравнению с яркими GPT-5.6, что может требовать настройки промптов для специфичных дизайн-задач.

03Сравнение с конкурентами

Grok 4.7 от xAI сохранил агрессивную цену ($2/$6), но теперь проигрывает GPT-6 Sol в стоимости входа и кэша. Claude Fable 5.1 остается флагманом для сложных творческих задач ($10/$50), но разрыв в цене с Sol становится все более оправданным только для узких high-end задач.

Ожидается скорое появление Sonnet 5.5 и Haiku 5.5. Если Haiku 5.5 сохранит текущую цену ($1/$5), она потеряет лидерство в самом дешевом сегменте перед GPT-6 Luna ($0.10/$0.50), которая в 10 раз дешевле.

04Кому подойдёт / что запустится

  • Для агентов и ботов: GPT-6 Luna — лучший выбор по соотношению цена/качество. Низкая стоимость кэша ($0.01/M) делает экономически viable длинные диалоги.
  • Для сложного кодинга и анализа: Claude Opus 5.5 (в режимах high или medium, избегая max). Отличная эффективность токенов и улучшенная логика.
  • Для генерации контента: GPT-6 Sol или Claude Fable 5.1. Sol предлагает баланс цены и качества, Fable — максимальное качество для креативных задач.
  • Локальный запуск: Данные модели (GPT-6, Opus 5.5) являются проприетарными API-решениями. Для локального запуска на GPU с 24GB+ VRAM (например, RTX 4090) в 2026 году актуальны открытые модели типа Llama 4 или Mistral Large v2, но они не конкурируют с GPT-6 Luna по цене токена при использовании API.
⚠️
Риск перерасхода. При использовании Claude Opus 5.5 в режиме "max" будьте осторожны: модель может превысить лимит вывода (128k токенов) в процессе "размышления", что приведет к ошибкам и дополнительным затратам. Используйте max_tokens с запасом или ограничьте режим размышления.
📌
Планируйте бюджет. Цены на GPT-5.6 вырастут на 25% в ноябре 2026 года. Если вы все еще используете 5.6, переход на GPT-6 Sol/ Luna дает не только лучшую производительность, но и двойную экономию (текущая скидка + отсутствие будущего повышения).

Источник: Simon Willison ↗