Релиз модели8 июля 2026 г., 21:45 МСК🤖 Auto

Cursor и SpaceXAI выпустили Grok 4.5: новый флагман для сложных задач

Cursor совместно с SpaceXAI представил Grok 4.5 — первую модель, обученную не только для кода, но и для широкого спектра интеллектуальных задач. Флагман уровня Opus доступен в Cursor с удвоенным лимитом на первую неделю.

Баннер новости 3140

Совместная разработка и новая парадигма обучения

Компания Cursor анонсировала выход модели Grok 4.5, созданной в партнерстве с SpaceXAI. Это первый продукт Cursor, который позиционируется не как узкоспециализированный инструмент для программирования, а как универсальный агент для решения сложных, долгосрочных задач. В отличие от предыдущей модели Composer 2.5, фокус которой был исключительно на коде, Grok 4.5 обучалась на триллионах токенов, включающих высококачественные STEM-задачи, научные статьи и данные о взаимодействии разработчиков с инструментами.

Ключевая особенность обучения — использование подкрепления (reinforcement learning) на сложных задачах в реалистичных средах. Разработчики создали распределенную систему агентов, которая генерирует задачи, настолько сложные, что даже передовые модели часто не справляются с ними. Это позволяет модели учиться расследовать проблемы, использовать инструменты, восстанавливаться после ошибок и верифицировать результаты.

Доступность и тарификация

Модель уже доступна на всех платформах Cursor: Desktop, Web, iOS, CLI и SDK. Для пользователей подписок Individual и Team предусмотрено значительное использование модели из пула первых лиц. В качестве промо-акции на первую неделю использования лимиты удваиваются.

Для разработчиков, предпочитающих прямое API-взаимодействие, установлены следующие цены:

Вариант модели Цена за входные токены (input) Цена за выходные токены (output)
Base (Grok 4.5) $2 / 1M токенов $6 / 1M токенов
Fast (ускоренная версия) $4 / 1M токенов $18 / 1M токенов

Технические детали и бенчмарки

Grok 4.5 является моделью типа Mixture-of-Experts (MoE). Важно отметить, что Grok 4.5 и Composer 2.5 представляют собой разные классы весов моделей. Cursor подтверждает поддержку обоих размеров, и новые модели Composer 2.5 будут выпускаться в будущем.

В отношении результатов тестирования Cursor сохраняет прозрачность:

  • SWE-Bench Pro и Terminal-Bench: Оценки основаны на данных, предоставленных третьими сторонами.
  • SWE-Bench Multilingual: Результат для GPT 5.5 получен во внутренних запусках Cursor.
  • CursorBench: Grok 4.5 демонстрирует преимущество, однако Cursor признает, что в обучающую выборку случайно попала более ранняя версия кодовой базы Cursor. Этот артефакт уже удален для будущих моделей, а сам бенчмарк CursorBench находится в процессе крупного обновления для исключения подобных искажений.

Безопасность

В связи с повышенной способностью модели к кибербезопасности, Cursor внедрил новые механизмы защиты, отражающие возможности Grok 4.5 в этой области. Модель готова к работе в сферах, требующих высокой точности: от разработки ПО до финансов и юриспруденции.

Источник: Cursor ↗