Рынок больших языковых моделей (LLM) переживает момент радикального удешевления. 22 сентября 2026 года Anthropic выпустила Claude Opus 5.5, а OpenAI — GPT-6 Sol и GPT-6 Luna. Ключевая новость: новые модели стоят вдвое дешевле своих предшественников из линейки GPT-5.6, что запускает новую фазу ценовой войны. Для практиков это означает возможность использовать более мощные модели для агентов и обработки данных при том же бюджете.
01Тарифная политика: кто дешевле?
OpenAI позиционирует GPT-6 Luna как идеальную модель для приложений (app-building). При цене $0.10 за входной токен и $0.50 за выходной, она бьет рекорды доступности, уступая по цене только устаревшим "Nano"-моделям. GPT-6 Sol занимает нишу среднего сегмента, став дешевле предыдущего поколения Sol.
Anthropic также снизила цены на Claude Opus 5.5 на 20% по сравнению с Opus 5.0. Важно отметить снижение стоимости чтения кэша (cache reads) на 60%, что критично для длинных сессий и агентов, где до 90% токенов обрабатываются по сниженной ставке.
| Модель | Input ($/M) | Cached Input ($/M) | Output ($/M) |
|---|---|---|---|
| GPT-6 Luna | $0.10 | $0.01 | $0.50 |
| GPT-6 Sol | $2.00 | $0.20 | $10.00 |
| Grok 4.7 | $2.00 | $0.50 | $6.00 |
| Claude Opus 5.5 | $4.00 | $0.20 | $20.00 |
| Claude Fable 5.1 | $10.00 | $0.25 | $50.00 |
02Производительность и стиль общения
Claude Opus 5.5 получил улучшения в коммуникации, став более четким и эффективным по токенам. Он позиционируется как замена Fable 5.1 по интеллекту, но дешевле. Однако тесты на генерацию SVG (тест "пеликан на велосипеде") выявили проблему с режимом "Max" (максимальное размышление).
В режиме max Opus 5.5 "зациклился" на анализе анатомии пеликана и превысил лимит в 128 000 выходных токенов, не вернув результат. Это заняло ~20 минут и стоило $2.56 за попытку. Режим max для Opus 5.5 пока не рекомендуется к использованию в продакшене из-за риска бесконечного рефлексивного цикла.
GPT-6 Luna демонстрирует высокую скорость и компетентность в задачах генерации SQL, HTML и JS. В тестах визуализации (SVG) модели семейства GPT-6 используют более приглушенные цвета по сравнению с яркими GPT-5.6, что может требовать настройки промптов для специфичных дизайн-задач.
03Сравнение с конкурентами
Grok 4.7 от xAI сохранил агрессивную цену ($2/$6), но теперь проигрывает GPT-6 Sol в стоимости входа и кэша. Claude Fable 5.1 остается флагманом для сложных творческих задач ($10/$50), но разрыв в цене с Sol становится все более оправданным только для узких high-end задач.
Ожидается скорое появление Sonnet 5.5 и Haiku 5.5. Если Haiku 5.5 сохранит текущую цену ($1/$5), она потеряет лидерство в самом дешевом сегменте перед GPT-6 Luna ($0.10/$0.50), которая в 10 раз дешевле.
04Кому подойдёт / что запустится
- Для агентов и ботов: GPT-6 Luna — лучший выбор по соотношению цена/качество. Низкая стоимость кэша ($0.01/M) делает экономически viable длинные диалоги.
- Для сложного кодинга и анализа: Claude Opus 5.5 (в режимах
highилиmedium, избегаяmax). Отличная эффективность токенов и улучшенная логика. - Для генерации контента: GPT-6 Sol или Claude Fable 5.1. Sol предлагает баланс цены и качества, Fable — максимальное качество для креативных задач.
- Локальный запуск: Данные модели (GPT-6, Opus 5.5) являются проприетарными API-решениями. Для локального запуска на GPU с 24GB+ VRAM (например, RTX 4090) в 2026 году актуальны открытые модели типа Llama 4 или Mistral Large v2, но они не конкурируют с GPT-6 Luna по цене токена при использовании API.
max_tokens с запасом или ограничьте режим размышления.Источник: Simon Willison ↗
