AI-новости5 октября 2026 г., 04:16 МСК🤖 Auto

GPT-6 Astra vs Gemini 4 Argon: Кто выиграл битву фронтенд-моделей

OpenAI, Google и Anthropic выпустили четыре топовые модели за месяц. Разбираем бенчмарки, цены и скрытые расходы на кэширование, чтобы понять, какая модель действительно выгодна для бизнеса.

Баннер новости 8916

Результаты гонки: GPT-6.1 Astra отменена, Sol — новый хит

За последние 30 дней на рынок вышли четыре флагманские модели: Claude Fable 5.1 (1 сентября), GPT-6 Astra (3 сентября), GPT-6.1 Sol и Gemini 4 Argon (конец сентября). Ключевое событие — OpenAI отозвала модель GPT-6.1 Astra 28 сентября из-за провала тестов на безопасность. Теперь GPT-6 Astra остается топ-моделью компании, а GPT-6.1 Sol позиционируется как доступная альтернатива.

Сравнение характеристик и цен

Ценообразование сильно различается. Astra и Fable 5.1 стоят дорого ($10/$50 за вход/выход), тогда как Sol и Argon — в 5 раз дешевле. Важно: Argon предлагает вводную цену, которая удвоится позже. Для агентов критична стоимость чтения кэша: Astra требует $1.00 за 1M токенов, что в 10 раз дороже Sol.

d>Кэш-вход ($/1M)
Параметр GPT-6 Astra GPT-6.1 Sol Gemini 4 Argon Claude Fable 5.1
Разработчик OpenAI OpenAI Google DeepMind Anthropic
Дата выхода 3 сен 2026 29 сен 2026 30 сен 2026 1 сен 2026
Цена (вход/выход, $/1M) $10 / $50 $2 / $10 $2 / $10 (вводная) $10 / $50
$1.00 $0.10 $0.10 (вводная) $0.25
Контекстное окно 1.05M 1.05M Не раскрыто 1M
Макс. вывод за раз 128K 128K 1M 128K

Бенчмарки: где кто лидирует

Единого лидера нет. Gemini 4 Argon выигрывает в задачах с длинной историей (DeepSWE v1.1: 77.9%) и финансах (Vals Index: 68.9%). GPT-6 Astra доминирует в сложной инженерии (FrontierSWE v2: 65.5%) и управлении компьютером (OSWorld-2.0: 72.6%). GPT-6.1 Sol показывает результаты, близкие к Astra, но при стоимости в 5 раз ниже.

Бенчмарк Что тестирует Gemini 4 Argon GPT-6 Astra Claude Fable 5.1
DeepSWE v1.1 Длинноцепочечная разработка 77.9% 74.1% 67.4%
Vals Index Финансы, право, код 68.9% 63.1% 65.8%
FrontierSWE v2 Фронтенд-инженерия 55.0% 65.5% 56.3%
OSWorld-2.0 Управление ПК 69.2% 72.6% Не в таблице

Скрытые расходы: кэш решает всё

Несмотря на одинаковую списочную цену ($10/$50), реальная стоимость задачи у Claude Fable 5.1 выше ($9.18 против $4.72 у Astra) из-за большего расхода токенов. Однако для агентов, часто читающих контекст, расклад меняется. При кэшировании 200K токенов на 100 шагов Astra стоит $20, а Sol и Argon — всего $2. Это делает дешевые модели безальтернативными для высоконагруженных CI/CD ботов.

Итоговая рекомендация

  • Для большинства команд: GPT-6.1 Sol. Лучшее соотношение цены и качества, близкое к Astra.
  • Для сложных исследований и инженерии: GPT-6 Astra. Лидер по качеству, но дорогая.
  • Для длинных отчетов: Gemini 4 Argon. Единственная модель с выводом до 1M токенов.
  • Для агентов с частым чтением: GPT-6.1 Sol или Gemini 4 Argon. Минимальная стоимость кэша ($0.10).

Обратите внимание: доступ к Argon ограничен программой Fairwind, а Astra имеет ограничения на кибербезопасность в публичной версии. Перед миграцией тестируйте модели на своих данных, так как вендоры используют разные методики оценки.

Источник: MarkTechPost ↗