Релиз модели15 сентября 2026 г., 20:04 МСК🤖 Auto

NVIDIA Vera Rubin и Groq 3 LPX: 35x рост эффективности на ватт

NVIDIA представила платформу Vera Rubin NVL72 с ускорителем Groq 3 LPX, обеспечивающую до 35-кратное увеличение пропускной способности на ватт для высокочастотных AI-задач по сравнению с поколением GB200.

Баннер новости 7557

Новый стандарт энергоэффективности AI-фабрик

15 сентября 2026 года NVIDIA анонсировала платформу Vera Rubin, где ключевой метрикой ценности объявлена не абсолютная производительность, а производительность на ватт. Центральным элементом стала система Vera Rubin NVL72, оптимизированная для работы с моделями от 2 триллионов параметров (2T+) в условиях высокой интерактивности и длинного контекста. По сравнению с предыдущим поколением GB200 NVL72, новая архитектура демонстрирует рост пропускной способности до 35x на мегаватт.

Магия Groq 3 LPX: детерминированное выполнение

Для задач, требующих минимальной задержки, в платформу интегрирован ускоритель Groq 3 LPX. Его главное преимущество — модель детерминированного выполнения (Deterministic Execution). Компилятор LPU заранее планирует перемещение данных и выполнение операций с точностью до тактового цикла для всех 256 чипов в стойке. Это позволяет точно предсказать кривую потребления тока, что открывает путь к инновационным методам управления питанием.

Технологии PEP и CPS: борьба с просадками напряжения

Используя предсказуемость нагрузки, Groq 3 LPX применяет две технологии для снижения энергопотребления:

  • Preemptive Power (PEP): заранее подготавливает систему подачи питания к изменениям спроса, предотвращая резкие скачки.
  • Clock Period Synthesis (CPS): формирует профиль нагрузки, сглаживая резкие пики потребления.

Вместе они снижают «напряжение запаса прочности» (voltage guardband) более чем на 60%. Поскольку мощность пропорциональна квадрату напряжения, даже небольшое снижение guardband дает значительную экономию энергии, которую можно перенаправить на вычисления.

Управление питанием на уровне завода и стойки

Энергоэффективность достигается не только на уровне чипа, но и на уровне инфраструктуры:

  • Уровень завода: ПО NVIDIA DSX MaxLPS перераспределяет мощность между стойками. Это позволяет увеличить количество развернутых GPU на 40% в рамках того же энергетического лимита сайта и повысить общую пропускную способность токенов на 35%.
  • Уровень стойки: Конденсаторы и ПО Intelligent Power Smoothing поглощают всплески мощности, позволяя проектировать ИИ-фабрики на основе устойчивого спроса, а не пиковых нагрузок.

Сравнительные характеристики

Параметр NVIDIA Vera Rubin NVL72 + Groq 3 LPX Предыдущее поколение (GB200 NVL72)
Пропускная способность (Throughput) на ватт До 35x выше Базовый уровень
Снижение напряжения guardband > 60% Стандартное
Дополнительные GPU в стойке (за счет DSX MaxLPS) +40% Информация недостаточна
Рост общей пропускной способности токенов +35% Информация недостаточна

Интеграция Groq 3 LPX с Vera Rubin решает главную проблему современных AI-фабрик: дефицит энергии. Переход от реактивного управления питанием к проактивному, основанному на детерминизме, позволяет извлекать максимум вычислительной мощности из каждого ватта, что критически важно для масштабирования агентов и сервисов с высокой интерактивностью.

Источник: NVIDIA dev blog ↗