AI-новости4 августа 2026 г., 18:17 МСК🤖 Auto

NVIDIA Vera BlueField-4: ускорение хранилищ в 3.21x и открытый cuFile

NVIDIA представила процессор Vera BlueField-4 STX с пропускной способностью в 3.21 раза выше x86 CPU и открыла API cuFile для прямого доступа GPU к данным.

Баннер новости 5053

Проблема узкого горлышка в эпоху AI-агентов

Рост требований к контекстным окнам и массивным датасетам привел к тому, что традиционные хранилища больше не справляются с нагрузкой. Современные GPU способны инициировать тысячи параллельных запросов к данным, что требует от систем хранения не просто емкости, а способности в реальном времени шифровать, сжимать и верифицировать информацию. NVIDIA на конференции FMS продемонстрировала, что ключ к решению этой проблемы — интеграция вычислений непосредственно в инфраструктуру хранения.

Производительность NVIDIA Vera BlueField-4 STX

Центральным элементом новой архитектуры стал процессор NVIDIA Vera BlueField-4 STX. Бенчмарки показывают, что он обеспечивает до 3.21x более высокую пропускную способность по сравнению с классическими x86-процессорами в двухэтапном конвейере сжатия и шифрования. Это позволяет хранилищам поглощать потоки данных от AI-фабрик без необходимости масштабирования вычислительных мощностей.

Параметр Решение NVIDIA (Vera BlueField-4 STX) Альтернатива (x86 CPU)
Пропускная способность (сжатие + шифрование) До 3.21x выше Базовый уровень
Задержка доступа к данным Микросекунды Миллисекунды/секунды (исторически)
Архитектура GPU-initiated storage requests CPU-mediated access

Открытие API cuFile и переход к GPU-Direct Storage

NVIDIA объявила об открытии исходных кодов API cuFile, ядра технологии GPUDirect Storage. Это позволяет графическим процессорам читать и записывать данные в хранилище напрямую, минуя CPU. Используя сотни тысяч потоков GPU и быструю память, cuFile обеспечивает безопасный доступ к данным за микросекунды. Инициатива поддерживает Open Secure AI Alliance, где NVIDIA, Google, Intel и Meta выступают со-хранителями стандартов безопасности.

Инициатива Storage-Next и фреймворк SCADA

Для стандартизации отрасли NVIDIA запустила инициативу Storage-Next, объединяющую более 40 вендоров, включая DDN, KIOXIA и Micron. В основе лежит фреймворк SCADA (Scaled, Accelerated Data Access), который позволяет GPU извлекать только необходимые данные напрямую в свою память. SCADA решает проблему безопасности, разделяя приложение на пользовательскую часть (для скорости) и привилегированный компонент (для защиты), что соответствует стандартам Linux.

Экосистема и будущее AI-хранилищ

Решения строятся на базе платформы NVIDIA Rubin и используют единый стек безопасности NVIDIA DOCA. Появление CMX (Context Memory Storage) создает новый уровень для агентов с длинным контекстом. Как отметил Свен Оеме (CTO DDN), успех AI будет определяться не объемом инфраструктуры, а эффективностью ее использования, что обеспечивает прямое соединение между GPU и данными.

Источник: NVIDIA Blog ↗