Проблема узкого горлышка в эпоху AI-агентов
Рост требований к контекстным окнам и массивным датасетам привел к тому, что традиционные хранилища больше не справляются с нагрузкой. Современные GPU способны инициировать тысячи параллельных запросов к данным, что требует от систем хранения не просто емкости, а способности в реальном времени шифровать, сжимать и верифицировать информацию. NVIDIA на конференции FMS продемонстрировала, что ключ к решению этой проблемы — интеграция вычислений непосредственно в инфраструктуру хранения.
Производительность NVIDIA Vera BlueField-4 STX
Центральным элементом новой архитектуры стал процессор NVIDIA Vera BlueField-4 STX. Бенчмарки показывают, что он обеспечивает до 3.21x более высокую пропускную способность по сравнению с классическими x86-процессорами в двухэтапном конвейере сжатия и шифрования. Это позволяет хранилищам поглощать потоки данных от AI-фабрик без необходимости масштабирования вычислительных мощностей.
| Параметр | Решение NVIDIA (Vera BlueField-4 STX) | Альтернатива (x86 CPU) |
|---|---|---|
| Пропускная способность (сжатие + шифрование) | До 3.21x выше | Базовый уровень |
| Задержка доступа к данным | Микросекунды | Миллисекунды/секунды (исторически) |
| Архитектура | GPU-initiated storage requests | CPU-mediated access |
Открытие API cuFile и переход к GPU-Direct Storage
NVIDIA объявила об открытии исходных кодов API cuFile, ядра технологии GPUDirect Storage. Это позволяет графическим процессорам читать и записывать данные в хранилище напрямую, минуя CPU. Используя сотни тысяч потоков GPU и быструю память, cuFile обеспечивает безопасный доступ к данным за микросекунды. Инициатива поддерживает Open Secure AI Alliance, где NVIDIA, Google, Intel и Meta выступают со-хранителями стандартов безопасности.
Инициатива Storage-Next и фреймворк SCADA
Для стандартизации отрасли NVIDIA запустила инициативу Storage-Next, объединяющую более 40 вендоров, включая DDN, KIOXIA и Micron. В основе лежит фреймворк SCADA (Scaled, Accelerated Data Access), который позволяет GPU извлекать только необходимые данные напрямую в свою память. SCADA решает проблему безопасности, разделяя приложение на пользовательскую часть (для скорости) и привилегированный компонент (для защиты), что соответствует стандартам Linux.
Экосистема и будущее AI-хранилищ
Решения строятся на базе платформы NVIDIA Rubin и используют единый стек безопасности NVIDIA DOCA. Появление CMX (Context Memory Storage) создает новый уровень для агентов с длинным контекстом. Как отметил Свен Оеме (CTO DDN), успех AI будет определяться не объемом инфраструктуры, а эффективностью ее использования, что обеспечивает прямое соединение между GPU и данными.
Источник: NVIDIA Blog ↗
