Релиз модели30 сентября 2026 г., 18:18 МСК🤖 Auto

CoreWeave и NVIDIA: Vera Rubin ускорил Devin в 4.8 раза

CoreWeave вывела в продакшн системы NVIDIA Vera Rubin NVL72. Лаборатория Cognition первой применила их для Devin, получив кратный рост скорости генерации кода.

Баннер новости 8614

Новое железо уже в продакшене

На конференции Fully Connected в Сан-Франциско CoreWeave объявила о доступности систем NVIDIA Vera Rubin NVL72 с сетью Spectrum-X 102.4T Ethernet. Это не просто анонс: компания уже развернула первые стойки, а лаборатория Cognition (разработчик AI-инженера Devin) перевела свои рабочие нагрузки на новую платформу. Также анонсирован процессор NVIDIA Vera — первое CPU, созданное специально для агентов ИИ.

Результаты тестирования: 4.8x прирост

Cognition протестировала Vera Rubin NVL72 на реальных задачах из датасета FrontierCode, сравнив производительность с базовой линией на GB200 NVL72. Ключевой метрикой стала пропускная способность токенов (token throughput) при выводе моделей (inference). Для сложных задач SWE-2 новый чип показал значительное преимущество, что критично для снижения стоимости генерации кода в реальном времени.

Метрика / Параметр Результат / Значение
Рост пропускной способности токенов (SWE-2) до 4.8x выше, чем на GB200 NVL72
Ускорение запуска песочниц агентов (NVIDIA Vera CPU) более 3x быстрее
Производительность на Terminal-Bench (Vera CPU) прирост 1.7x по всем пройденным задачам
Плотность вычислений (Vera CPU) 128 CPU, 11 264 ядер в стойке (до 11 000 изолированных сред)
Скорость Serverless RL обучения в 1.4x быстрее при стоимости на 40% ниже

NVIDIA Vera: CPU для тысяч агентов

Параллельно с GPU-решениями, CoreWeave представила процессор NVIDIA Vera. Его главная задача — обеспечение низкой задержки при запуске тысяч изолированных сред для агентов. В одной стойке размещается 128 процессоров и 11 264 ядра, что позволяет одновременно запускать более 11 000 изолированных сред. Использование сети Spectrum-X и ускорителей BlueField-4 DP обеспечивает безопасную и быструю коммуникацию между агентами и инфраструктурой.

CoreWeave Forge: замкнутый цикл обучения

Для упрощения перехода от прототипа к продакшену запущена платформа CoreWeave Forge. Она объединяет инструменты для обучения, оценки и улучшения моделей, устраняя разрывы между разными вендорами. Ключевые новинки:

  • CoreWeave ARIA: ИИ-ассистент для анализа экспериментов и предложения изменений кода.
  • CoreWeave Agent Lens: сервис наблюдаемости, повышающий точность обнаружения ошибок на 20% и снижающий стоимость исправлений вдвое.
  • Serverless RL и SFT: бессерверное обучение с подкреплением и тонкой настройкой, которое работает быстрее и дешевле самописных кластеров.

Среди первых пользователей платформы — Canva, Capital One и MasterClass. Платформа поддерживает модели NVIDIA Nemotron для создания кастомных reasoning-агентов.

Почему это важно

Исторически инфраструктура для обучения и инференса была разрознена, что приводило к потере данных и эффективности. Совместная работа NVIDIA и CoreWeave позволяет использовать одни и те же данные из продакшена для улучшения моделей (RL Rollouts) без необходимости переразвертывания кластеров. CoreWeave остается единственным облаком с Platinum рейтингом в SemiAnalysis ClusterMAX, обслуживая 9 из 10 ведущих AI-лабораторий, что делает эту связку стандартом для enterprise-уровня.

Бенчмарки

БенчмаркNVIDIA Vera Rubin NVL72GB200 NVL72
SWE-bench4.8x1x

Жирным — лучший результат в строке. Источник цифр — официальная публикация.

Источник: NVIDIA Blog ↗