Архитектура Vera: 88 ядер Olympus и SCF
Ключевым элементом новой платформы является NVIDIA Vera CPU, интегрированный в процессор BlueField-4 STX. В его состав входят 88 ядер Olympus (совместимых с инструкциями Armv9.2) и поддержка 176 потоков пространственной многопоточности (Spatial Multithreading). Архитектура использует Scalable Coherency Fabric (SCF) с пропускной способностью до 3.4 ТБ/с и 164 МБ единого кэша L3, а также память SOCAMM2 LPDDR5X с общей пропускной способностью 1.2 ТБ/с (до 14 ГБ/с на ядро). Это позволяет обрабатывать интенсивные задачи хранения данных без узких мест, характерных для традиционных CPU.
Результаты бенчмарков: Vera против x86
Тестирование проводилось на уровне микробенчмарков, исключая влияние дисковой подсистемы и сети. Результаты демонстрируют значительное преимущество Vera в критически важных для AI-инфраструктуры операциях:
| Операция | Прирост скорости (Vera vs x86) | Значение для AI |
|---|---|---|
| Проверка целостности (CRC32C) | до 3.67x | Быстрая валидация KV-кэша и данных агентов |
| Восстановление данных (Reed-Solomon) | до 3.26x | Ускоренная реконструкция данных при сбоях |
| Сжатие (Zstandard/LZ4) | до 3.29x | Снижение требований к емкости и пропускной способности |
| Шифрование (AES/OpenSSL) | до 1.43x | Безопасность данных без задержек в пайплайне |
| Многоэтапный пайплайн хранения | до 3.21x | Комплексная обработка данных агентами |
Почему это важно для Agentic AI
В эпоху агентов ИИ (Agentic AI) хранилище становится активным участником рабочего процесса. Каждый шаг агента требует чтения/записи, сжатия, шифрования и проверки контрольных сумм. При высокой конкурентности (тысячи одновременных агентов) традиционные x86-процессоры становятся «узким горлышком», замедляя генерацию токенов и выполнение инструментов. Vera CPU переносит вычислительную мощность непосредственно в путь данных, позволяя масштабировать плотность сервисов и количество параллельных потоков данных при снижении энергопотребления и требований к охлаждению.
Интеграция в экосистему STX
BlueField-4 STX является частью фундамента NVIDIA STX для AI-нативных платформ данных. Использование единой архитектуры Vera как для GPU (Rubin), так и для процессоров хранения обеспечивает согласованность производительности. Это позволяет инфраструктуре обрабатывать растущие объемы контекстных окон и постоянную память агентов, не ограничиваясь скоростью SSD или сети, а обеспечивая готовность данных на уровне процессора.
Источник: NVIDIA dev blog ↗
