Новое железо уже в продакшене
На конференции Fully Connected в Сан-Франциско CoreWeave объявила о доступности систем NVIDIA Vera Rubin NVL72 с сетью Spectrum-X 102.4T Ethernet. Это не просто анонс: компания уже развернула первые стойки, а лаборатория Cognition (разработчик AI-инженера Devin) перевела свои рабочие нагрузки на новую платформу. Также анонсирован процессор NVIDIA Vera — первое CPU, созданное специально для агентов ИИ.
Результаты тестирования: 4.8x прирост
Cognition протестировала Vera Rubin NVL72 на реальных задачах из датасета FrontierCode, сравнив производительность с базовой линией на GB200 NVL72. Ключевой метрикой стала пропускная способность токенов (token throughput) при выводе моделей (inference). Для сложных задач SWE-2 новый чип показал значительное преимущество, что критично для снижения стоимости генерации кода в реальном времени.
| Метрика / Параметр | Результат / Значение |
|---|---|
| Рост пропускной способности токенов (SWE-2) | до 4.8x выше, чем на GB200 NVL72 |
| Ускорение запуска песочниц агентов (NVIDIA Vera CPU) | более 3x быстрее |
| Производительность на Terminal-Bench (Vera CPU) | прирост 1.7x по всем пройденным задачам |
| Плотность вычислений (Vera CPU) | 128 CPU, 11 264 ядер в стойке (до 11 000 изолированных сред) |
| Скорость Serverless RL обучения | в 1.4x быстрее при стоимости на 40% ниже |
NVIDIA Vera: CPU для тысяч агентов
Параллельно с GPU-решениями, CoreWeave представила процессор NVIDIA Vera. Его главная задача — обеспечение низкой задержки при запуске тысяч изолированных сред для агентов. В одной стойке размещается 128 процессоров и 11 264 ядра, что позволяет одновременно запускать более 11 000 изолированных сред. Использование сети Spectrum-X и ускорителей BlueField-4 DP обеспечивает безопасную и быструю коммуникацию между агентами и инфраструктурой.
CoreWeave Forge: замкнутый цикл обучения
Для упрощения перехода от прототипа к продакшену запущена платформа CoreWeave Forge. Она объединяет инструменты для обучения, оценки и улучшения моделей, устраняя разрывы между разными вендорами. Ключевые новинки:
- CoreWeave ARIA: ИИ-ассистент для анализа экспериментов и предложения изменений кода.
- CoreWeave Agent Lens: сервис наблюдаемости, повышающий точность обнаружения ошибок на 20% и снижающий стоимость исправлений вдвое.
- Serverless RL и SFT: бессерверное обучение с подкреплением и тонкой настройкой, которое работает быстрее и дешевле самописных кластеров.
Среди первых пользователей платформы — Canva, Capital One и MasterClass. Платформа поддерживает модели NVIDIA Nemotron для создания кастомных reasoning-агентов.
Почему это важно
Исторически инфраструктура для обучения и инференса была разрознена, что приводило к потере данных и эффективности. Совместная работа NVIDIA и CoreWeave позволяет использовать одни и те же данные из продакшена для улучшения моделей (RL Rollouts) без необходимости переразвертывания кластеров. CoreWeave остается единственным облаком с Platinum рейтингом в SemiAnalysis ClusterMAX, обслуживая 9 из 10 ведущих AI-лабораторий, что делает эту связку стандартом для enterprise-уровня.
Бенчмарки
| Бенчмарк | NVIDIA Vera Rubin NVL72 | GB200 NVL72 |
|---|---|---|
| SWE-bench | 4.8x | 1x |
Жирным — лучший результат в строке. Источник цифр — официальная публикация.
Источник: NVIDIA Blog ↗
