Масштабное развертывание Helios в Azure
Microsoft и AMD официально объявили о партнерстве, в рамках которого Microsoft обязуется развернуть ускоритель AMD Helios в своих дата-центрах и сделать его доступным для клиентов Azure. Это решение направлено на поддержку workload'ов для обучения и инференса моделей уровня frontier, включая возможность тонкой настройки открытых моделей, таких как Kimi K3. Партнерство также затронет Microsoft Foundry для корпоративных клиентов.
Технические характеристики Helios и MI455X
Ключевым элементом системы является Instinct MI455X. Один rack-модуль Helios объединяет 72 таких GPU, создавая мощную вычислительную платформу. AMD заявляет о следующих характеристиках системы:
- Память: 31.1 ТБ HBM4 суммарно на систему.
- Вычислительная мощность: до 1.4 EFLOPS (FP8) и 2.9 EFLOPS (FP4) для AI-оптимизированных типов данных.
- Пропускная способность (Scale-up): 260 ТБ/с внутри стойки.
- Пропускная способность (Scale-out): 43 ТБ/с через UALink over Ethernet (в 2 раза выше, чем у аналогов, по заявлению AMD).
Сравнение с конкурентами
AMD позиционирует Helios как прямую альтернативу системе Nvidia Vera Rubin NVL72. Ниже приведено сравнение заявленных метрик масштабирования:
| Параметр | AMD Helios (MI455X) | Nvidia Vera Rubin NVL72 |
|---|---|---|
| Количество GPU в rack | 72 | 72 |
| Scale-up Bandwidth | 260 TB/s | ~260 TB/s (на уровне) |
| Scale-out Bandwidth (UALink/Ethernet) | 43 TB/s | ~21.5 TB/s (оценка AMD) |
| Тип памяти | HBM4 | Информация недостаточна |
Новые VM-серии на базе Epyc Venice
Помимо GPU, Azure расширит предложение виртуальных машин на базе шестого поколения процессоров AMD Epyc Venice. Будут доступны две новые серии:
- HDv2: Оптимизированы для «агентного ИИ» (Agentic AI) и конвейеров обработки данных.
- HXv2: Предназначены для рабочих нагрузок проектирования полупроводников.
Также Microsoft интегрирует существующие DPU Pensando в свои сервисы Azure Boost для ускорения сетевых операций и работы с хранилищами.
Стратегическое значение
Это решение становится серьезным ударом по монополии Nvidia в сегменте гиперскейлеров. Ранее AMD уже заключила крупные соглашения с OpenAI и Meta, но выход на Azure открывает доступ к широкой базе корпоративных клиентов. Точные объемы инвестиций или количество ватт не раскрываются, однако контекст «гигаваттных» установок и сотен миллиардов долларов потенциальной выручки указывает на масштаб проекта. Детали реализации UALink over Ethernet будут проверены на практике во время мероприятия AMD Advancing AI.
Источник: Tom's Hardware ↗
