AI-новости22 июля 2026 г., 03:19 МСК🤖 Auto

Dell Pro Max GB10: Кластер из двух Nvidia Grace Blackwell за $12k

Dell представила Pro Max на базе GB10, позволяющую собрать локальный AI-кластер с 256 ГБ памяти. Тесты показали, что объединение двух систем через 200Gbps RoCE дает альтернативу дорогим GPU-серверам.

Баннер новости 4091

Аппаратная платформа и цена

Dell Pro Max с чипом Nvidia GB10 — это компактное решение (150x150x51 мм), которое часто сравнивают с референсным DGX Spark. Ключевое отличие Dell — более мощный блок питания (280 Вт против 240 Вт у Spark) и улучшенный дизайн корпуса с гексагональными решетками, которые не цепляют ткань. Система оснащена 10-ядерным ARM-процессором (Cortex-X925/A725), 6144 ядрами Blackwell GPU и 128 ГБ унифицированной памяти LPDDR5X.

Цена тестируемой конфигурации с накопителем 4 ТБ составляет $6 332. Это делает сборку кластера из двух таких устройств (256 ГБ RAM суммарно) значительно дешевле, чем покупка сервера с четырьмя дискретными GPU (RTX Pro 5000/6000), где затраты легко превышают $20 000.

Сетевая инфраструктура: 200Gbps RoCE

Для масштабирования AI-вычислений Dell Pro Max использует сетевой адаптер Nvidia ConnectX 7 с поддержкой протокола RoCE (Remote Direct Memory Access over Converged Ethernet). Это позволяет распределять модели между узлами кластера, как в дата-центрах. Важно отметить: система поддерживает только Ethernet, InfiniBand не используется. Для достижения максимальной пропускной способности в 200 Гбит/с требуется специальная настройка интерфейсов, так как физический порт QSFP логически разделен на два канала PCIe 5.0 x4.

Сложности настройки и прошивок

Процесс объединения двух систем в кластер оказался нетривиальным. Автор теста столкнулся с проблемой: после подключения кабелей QSFP и настройки SSH тесты NCCL показывали лишь малую долю от ожидаемой пропускной способности RDMA. Причина крылась в рассинхронизации прошивок. Даже если DGX Dashboard сообщал об обновлении, пакет fwupd на втором узле зависал на этапе фазирования. Принудительная установка обновления разблокировала цепочку апдейтов прошивок, и после перезагрузки кластер заработал на полную мощность.

Сравнение характеристик

Параметр Dell Pro Max GB10 Nvidia DGX Spark (Reference)
Процессор Nvidia GB10 (10x Arm Cortex) Nvidia GB10 (10x Arm Cortex)
Память 128 ГБ LPDDR5X 128 ГБ LPDDR5X
Накопитель 4 ТБ PCIe Gen 4 NVMe 4 ТБ PCIe Gen 5 NVMe
Сеть ConnectX 7, 200Gbps (QSFP) ConnectX 7, 200Gbps (QSFP)
Блок питания 280W USB-C 240W USB-C
Цена (тестовая) $6 332 Информация недостаточна

Зачем это нужно энтузиастам?

Локальные AI-кластеры решают проблему нехватки памяти для запуска больших языковых моделей (LLM), которые не помещаются в 128 ГБ. Альтернативы — сборка кастомного сервера на Threadripper/Epyc с несколькими GPU — требует сложного охлаждения, мощных блоков питания (до 1800 Вт на одну розетку 15А в США) и стоит неоправданно дорого. Dell Pro Max предлагает «plug-and-play» решение с тихой работой и приемлемой производительностью инференса для домашних и малых офисных лабораторий.

Источник: Tom's Hardware ↗