Совместная разработка и новая парадигма обучения
Компания Cursor анонсировала выход модели Grok 4.5, созданной в партнерстве с SpaceXAI. Это первый продукт Cursor, который позиционируется не как узкоспециализированный инструмент для программирования, а как универсальный агент для решения сложных, долгосрочных задач. В отличие от предыдущей модели Composer 2.5, фокус которой был исключительно на коде, Grok 4.5 обучалась на триллионах токенов, включающих высококачественные STEM-задачи, научные статьи и данные о взаимодействии разработчиков с инструментами.
Ключевая особенность обучения — использование подкрепления (reinforcement learning) на сложных задачах в реалистичных средах. Разработчики создали распределенную систему агентов, которая генерирует задачи, настолько сложные, что даже передовые модели часто не справляются с ними. Это позволяет модели учиться расследовать проблемы, использовать инструменты, восстанавливаться после ошибок и верифицировать результаты.
Доступность и тарификация
Модель уже доступна на всех платформах Cursor: Desktop, Web, iOS, CLI и SDK. Для пользователей подписок Individual и Team предусмотрено значительное использование модели из пула первых лиц. В качестве промо-акции на первую неделю использования лимиты удваиваются.
Для разработчиков, предпочитающих прямое API-взаимодействие, установлены следующие цены:
| Вариант модели | Цена за входные токены (input) | Цена за выходные токены (output) |
|---|---|---|
| Base (Grok 4.5) | $2 / 1M токенов | $6 / 1M токенов |
| Fast (ускоренная версия) | $4 / 1M токенов | $18 / 1M токенов |
Технические детали и бенчмарки
Grok 4.5 является моделью типа Mixture-of-Experts (MoE). Важно отметить, что Grok 4.5 и Composer 2.5 представляют собой разные классы весов моделей. Cursor подтверждает поддержку обоих размеров, и новые модели Composer 2.5 будут выпускаться в будущем.
В отношении результатов тестирования Cursor сохраняет прозрачность:
- SWE-Bench Pro и Terminal-Bench: Оценки основаны на данных, предоставленных третьими сторонами.
- SWE-Bench Multilingual: Результат для GPT 5.5 получен во внутренних запусках Cursor.
- CursorBench: Grok 4.5 демонстрирует преимущество, однако Cursor признает, что в обучающую выборку случайно попала более ранняя версия кодовой базы Cursor. Этот артефакт уже удален для будущих моделей, а сам бенчмарк CursorBench находится в процессе крупного обновления для исключения подобных искажений.
Безопасность
В связи с повышенной способностью модели к кибербезопасности, Cursor внедрил новые механизмы защиты, отражающие возможности Grok 4.5 в этой области. Модель готова к работе в сферах, требующих высокой точности: от разработки ПО до финансов и юриспруденции.
Источник: Cursor ↗
