Новая линейка и ценообразование
OpenAI официально выпустила GPT-5.6, разделив модель на три тарифные версии. Ключевое изменение — агрессивное снижение стоимости для массового использования агентов и кодинга. Цены указаны за запрос/месяц (условные единицы, сопоставимые с долларом США в контексте статьи):
| Модель | Цена (запрос) | Цена (подписка/мес) | Позиционирование |
|---|---|---|---|
| GPT-5.6 Sol | $5 | $30 | Флагман-агент, «рабочая лошадка» |
| GPT-5.6 Terra | $2.50 | $15 | Бюджетный вариант |
| GPT-5.6 Luna | $1 | $6 | Самый дешевый, превосходит GPT-5.5 (max) по цене |
| Opus (конкурент) | $5 | $25 | Сравнительная точка |
| Fable (конкурент) | $10 | $50 | Высший класс рассуждений |
Кто есть кто: Sol против Fable
Аналитики и ранние пользователи проводят четкое разделение ролей. Fable остается «архитектором» и «коллаборатором» — он умнее, лучше справляется с самыми сложными интеллектуальными задачами и имеет меньший риск «хвостовых событий» (tail risk). Однако он дорог и требует строгих ограничений.
Sol — это «рабочая лошадка» (workhorse). Он идеален для выполнения конкретных, известных задач: использование компьютера, веб-поиск, кодинг. Sol дешевле, быстрее и эффективнее в рутинных агентных сценариях, но может быть менее точным в сложных рассуждениях, чем Fable.
Бенчмарки и внутренние метрики
OpenAI заявляет о прорыве в эффективности исследований. Внутренние метрики показывают:
- Среднее количество токенов на активного исследователя выросло более чем в 2 раза по сравнению с GPT-5.5.
- Вычислительные ресурсы, затрачиваемые на внутренний кодинг, увеличились в 100 раз за полгода.
- Использование агентов выросло в 22 раза.
В тестах Agents’ Last Exam, AA Agent Coding Index v1.1 и BrowseComp Sol превосходит Fable и Opus. В медицине (HealthBench) Sol показал лучшие результаты по согласию с врачами, чем ответы, написанные самими врачами, при стоимости $0.27 за ответ.
Практическое применение: как использовать
Рекомендация экспертов — не выбирать одну модель, а использовать их в паре. Задавайте сложные, творческие или стратегические вопросы Fable, а рутинные задачи, код и сбор информации поручайте Sol. Luna подходит для простых запросов, где важна скорость и низкая цена, превосходя GPT-5.5 (max effort) при стоимости в 25 раз ниже.
Важно для бизнеса
Запуск GPT-5.6 сигнализирует о переходе от «чата» к «агентному» использованию ИИ. Компании должны пересмотреть рабочие процессы, делегируя выполнение задач моделям, а не только генерацию идей. Снижение цены Luna делает массовый AI-агентный воркфлоу экономически целесообразным.
Источник: LessWrong ↗
