Новый стандарт энергоэффективности AI-фабрик
15 сентября 2026 года NVIDIA анонсировала платформу Vera Rubin, где ключевой метрикой ценности объявлена не абсолютная производительность, а производительность на ватт. Центральным элементом стала система Vera Rubin NVL72, оптимизированная для работы с моделями от 2 триллионов параметров (2T+) в условиях высокой интерактивности и длинного контекста. По сравнению с предыдущим поколением GB200 NVL72, новая архитектура демонстрирует рост пропускной способности до 35x на мегаватт.
Магия Groq 3 LPX: детерминированное выполнение
Для задач, требующих минимальной задержки, в платформу интегрирован ускоритель Groq 3 LPX. Его главное преимущество — модель детерминированного выполнения (Deterministic Execution). Компилятор LPU заранее планирует перемещение данных и выполнение операций с точностью до тактового цикла для всех 256 чипов в стойке. Это позволяет точно предсказать кривую потребления тока, что открывает путь к инновационным методам управления питанием.
Технологии PEP и CPS: борьба с просадками напряжения
Используя предсказуемость нагрузки, Groq 3 LPX применяет две технологии для снижения энергопотребления:
- Preemptive Power (PEP): заранее подготавливает систему подачи питания к изменениям спроса, предотвращая резкие скачки.
- Clock Period Synthesis (CPS): формирует профиль нагрузки, сглаживая резкие пики потребления.
Вместе они снижают «напряжение запаса прочности» (voltage guardband) более чем на 60%. Поскольку мощность пропорциональна квадрату напряжения, даже небольшое снижение guardband дает значительную экономию энергии, которую можно перенаправить на вычисления.
Управление питанием на уровне завода и стойки
Энергоэффективность достигается не только на уровне чипа, но и на уровне инфраструктуры:
- Уровень завода: ПО NVIDIA DSX MaxLPS перераспределяет мощность между стойками. Это позволяет увеличить количество развернутых GPU на 40% в рамках того же энергетического лимита сайта и повысить общую пропускную способность токенов на 35%.
- Уровень стойки: Конденсаторы и ПО Intelligent Power Smoothing поглощают всплески мощности, позволяя проектировать ИИ-фабрики на основе устойчивого спроса, а не пиковых нагрузок.
Сравнительные характеристики
| Параметр | NVIDIA Vera Rubin NVL72 + Groq 3 LPX | Предыдущее поколение (GB200 NVL72) |
|---|---|---|
| Пропускная способность (Throughput) на ватт | До 35x выше | Базовый уровень |
| Снижение напряжения guardband | > 60% | Стандартное |
| Дополнительные GPU в стойке (за счет DSX MaxLPS) | +40% | Информация недостаточна |
| Рост общей пропускной способности токенов | +35% | Информация недостаточна |
Интеграция Groq 3 LPX с Vera Rubin решает главную проблему современных AI-фабрик: дефицит энергии. Переход от реактивного управления питанием к проактивному, основанному на детерминизме, позволяет извлекать максимум вычислительной мощности из каждого ватта, что критически важно для масштабирования агентов и сервисов с высокой интерактивностью.
Источник: NVIDIA dev blog ↗
