AI-новости2 октября 2026 г., 16:16 МСК🤖 Auto

NVIDIA DGX Spark 64GB: локальный AI-суперкомпьютер за $4999

NVIDIA представила конфигурацию DGX Spark с 64 ГБ памяти. Устройство позволяет запускать модели до 100 млрд параметров локально, а при объединении двух блоков — до 200 млрд.

Баннер новости 8786

Новая конфигурация для локального AI

NVIDIA официально анонсировала версию DGX Spark с 64 ГБ унифицированной памяти. Это устройство позиционируется как персональный AI-суперкомпьютер, который позволяет разработчикам, исследователям и энтузиастам запускать сложные модели и агентов полностью локально, без зависимости от облачных сервисов. Аппаратная платформа базируется на суперчипе GB10 Grace Blackwell, оснащена сетевым адаптером NVIDIA ConnectX-7 и поставляется с предустановленной DGX OS и полным стеком NVIDIA AI.

Новая конфигурация доступна для предзаказа у ключевых партнеров: Acer, ASUS, Dell, Gigabyte, HP и MSI. Старт продаж назначен на 23 октября, стартовая цена составляет $4,999. При этом платформа сохраняет ту же программную базу и вычислительное ядро, что и более дорогая версия на 128 ГБ.

Масштабирование и производительность

Ключевая особенность DGX Spark — возможность бесшовного кластеризования. Два устройства можно соединить напрямую через кабель QSFP, используя утилиту NVIDIA Sync Cluster Assistant. Это не просто суммирует память, но и оптимизирует сетевое взаимодействие. В тестах с моделью Qwen 3.8 27B объединение двух блоков дало прирост производительности до 1.7x по сравнению с одним устройством, а общая доступная память увеличилась до 128 ГБ, что позволяет запускать модели объемом до 200 миллиардов параметров.

Характеристика Одна единица (64GB) Кластер из двух единиц (128GB)
Объем памяти 64 ГБ унифицированной 128 ГБ (объединенная)
Макс. размер модели До 100 млрд параметров До 200 млрд параметров
Сетевое подключение NVIDIA ConnectX-7 Прямое соединение QSFP (200 GbE)
Прирост производительности (Qwen 3.8 27B) Базовый уровень До 1.7x ускорение

Готовность к работе «из коробки»

NVIDIA делает акцент на простоте развертывания. Платформа поддерживает популярные рантаймы Ollama, vLLM, PyTorch и библиотеки CUDA-X AI сразу после включения. В ближайшее время выйдет приложение NVIDIA Sync Model Launcher, которое позволит запускать модели (например, Qwen3.8 27B) в несколько кликов, автоматически настраивая распределение нагрузки между устройствами и интегрируя их с браузерным редактором кода OpenCode.

Среди первых крупных приложений, поддерживающих платформу, — Blender, для которого готовится специальный установщик. Это открывает возможности для создания 3D-контента с использованием AI-инференса прямо на рабочем месте, разгружая основной ПК.

Сценарии использования

Платформа закрывает три основных сценария для разработчиков:

  • Круглосуточные AI-агенты: Запуск кодовых или исследовательских агентов, которые анализируют документы или пишут код, не отвлекая основной компьютер.
  • Инференс на рабочем месте: DGX Spark берет на себя тяжелые вычисления для генерации текста или изображений, позволяя использовать ноутбук для других задач.
  • Гибкое масштабирование: Возможность начать с одного устройства и добавить второе при росте требований к контекстному окну или количеству одновременных запросов без перенастройки ПО.

Источник: NVIDIA Blog ↗