Релиз модели20 июля 2026 г., 16:16 МСК🤖 Auto

Microsoft и AMD: Helios, MI455X и Venice в Azure. Детали атаки на Nvidia

Microsoft подтвердила масштабное развертывание rack-scale ускорителя AMD Helios на базе 72 GPU Instinct MI455X в облаке Azure. Партнерство включает новые VM-серии на CPU Epyc Venice и усиление конкуренции с Nvidia Vera Rubin.

Баннер новости 3953

Масштабное развертывание Helios в Azure

Microsoft и AMD официально объявили о партнерстве, в рамках которого Microsoft обязуется развернуть ускоритель AMD Helios в своих дата-центрах и сделать его доступным для клиентов Azure. Это решение направлено на поддержку workload'ов для обучения и инференса моделей уровня frontier, включая возможность тонкой настройки открытых моделей, таких как Kimi K3. Партнерство также затронет Microsoft Foundry для корпоративных клиентов.

Технические характеристики Helios и MI455X

Ключевым элементом системы является Instinct MI455X. Один rack-модуль Helios объединяет 72 таких GPU, создавая мощную вычислительную платформу. AMD заявляет о следующих характеристиках системы:

  • Память: 31.1 ТБ HBM4 суммарно на систему.
  • Вычислительная мощность: до 1.4 EFLOPS (FP8) и 2.9 EFLOPS (FP4) для AI-оптимизированных типов данных.
  • Пропускная способность (Scale-up): 260 ТБ/с внутри стойки.
  • Пропускная способность (Scale-out): 43 ТБ/с через UALink over Ethernet (в 2 раза выше, чем у аналогов, по заявлению AMD).

Сравнение с конкурентами

AMD позиционирует Helios как прямую альтернативу системе Nvidia Vera Rubin NVL72. Ниже приведено сравнение заявленных метрик масштабирования:

Параметр AMD Helios (MI455X) Nvidia Vera Rubin NVL72
Количество GPU в rack 72 72
Scale-up Bandwidth 260 TB/s ~260 TB/s (на уровне)
Scale-out Bandwidth (UALink/Ethernet) 43 TB/s ~21.5 TB/s (оценка AMD)
Тип памяти HBM4 Информация недостаточна

Новые VM-серии на базе Epyc Venice

Помимо GPU, Azure расширит предложение виртуальных машин на базе шестого поколения процессоров AMD Epyc Venice. Будут доступны две новые серии:

  • HDv2: Оптимизированы для «агентного ИИ» (Agentic AI) и конвейеров обработки данных.
  • HXv2: Предназначены для рабочих нагрузок проектирования полупроводников.

Также Microsoft интегрирует существующие DPU Pensando в свои сервисы Azure Boost для ускорения сетевых операций и работы с хранилищами.

Стратегическое значение

Это решение становится серьезным ударом по монополии Nvidia в сегменте гиперскейлеров. Ранее AMD уже заключила крупные соглашения с OpenAI и Meta, но выход на Azure открывает доступ к широкой базе корпоративных клиентов. Точные объемы инвестиций или количество ватт не раскрываются, однако контекст «гигаваттных» установок и сотен миллиардов долларов потенциальной выручки указывает на масштаб проекта. Детали реализации UALink over Ethernet будут проверены на практике во время мероприятия AMD Advancing AI.

Источник: Tom's Hardware ↗