Новая конфигурация для локального AI
NVIDIA официально анонсировала версию DGX Spark с 64 ГБ унифицированной памяти. Это устройство позиционируется как персональный AI-суперкомпьютер, который позволяет разработчикам, исследователям и энтузиастам запускать сложные модели и агентов полностью локально, без зависимости от облачных сервисов. Аппаратная платформа базируется на суперчипе GB10 Grace Blackwell, оснащена сетевым адаптером NVIDIA ConnectX-7 и поставляется с предустановленной DGX OS и полным стеком NVIDIA AI.
Новая конфигурация доступна для предзаказа у ключевых партнеров: Acer, ASUS, Dell, Gigabyte, HP и MSI. Старт продаж назначен на 23 октября, стартовая цена составляет $4,999. При этом платформа сохраняет ту же программную базу и вычислительное ядро, что и более дорогая версия на 128 ГБ.
Масштабирование и производительность
Ключевая особенность DGX Spark — возможность бесшовного кластеризования. Два устройства можно соединить напрямую через кабель QSFP, используя утилиту NVIDIA Sync Cluster Assistant. Это не просто суммирует память, но и оптимизирует сетевое взаимодействие. В тестах с моделью Qwen 3.8 27B объединение двух блоков дало прирост производительности до 1.7x по сравнению с одним устройством, а общая доступная память увеличилась до 128 ГБ, что позволяет запускать модели объемом до 200 миллиардов параметров.
| Характеристика | Одна единица (64GB) | Кластер из двух единиц (128GB) |
|---|---|---|
| Объем памяти | 64 ГБ унифицированной | 128 ГБ (объединенная) |
| Макс. размер модели | До 100 млрд параметров | До 200 млрд параметров |
| Сетевое подключение | NVIDIA ConnectX-7 | Прямое соединение QSFP (200 GbE) |
| Прирост производительности (Qwen 3.8 27B) | Базовый уровень | До 1.7x ускорение |
Готовность к работе «из коробки»
NVIDIA делает акцент на простоте развертывания. Платформа поддерживает популярные рантаймы Ollama, vLLM, PyTorch и библиотеки CUDA-X AI сразу после включения. В ближайшее время выйдет приложение NVIDIA Sync Model Launcher, которое позволит запускать модели (например, Qwen3.8 27B) в несколько кликов, автоматически настраивая распределение нагрузки между устройствами и интегрируя их с браузерным редактором кода OpenCode.
Среди первых крупных приложений, поддерживающих платформу, — Blender, для которого готовится специальный установщик. Это открывает возможности для создания 3D-контента с использованием AI-инференса прямо на рабочем месте, разгружая основной ПК.
Сценарии использования
Платформа закрывает три основных сценария для разработчиков:
- Круглосуточные AI-агенты: Запуск кодовых или исследовательских агентов, которые анализируют документы или пишут код, не отвлекая основной компьютер.
- Инференс на рабочем месте: DGX Spark берет на себя тяжелые вычисления для генерации текста или изображений, позволяя использовать ноутбук для других задач.
- Гибкое масштабирование: Возможность начать с одного устройства и добавить второе при росте требований к контекстному окну или количеству одновременных запросов без перенастройки ПО.
Источник: NVIDIA Blog ↗
