AI-новости18 сентября 2026 г., 15:17 МСК🤖 Auto

Huawei ускорила релиз Ascend 960: FP4-производительность выросла вдвое

Huawei перенесла запуск ускорителей Ascend 960 на 2027 год и объявила о двукратном росте производительности в формате FP4. Компания переходит на архитектуру SIMD+SIMT, чтобы конкурировать с NVIDIA.

Баннер новости 7796

Сдвиг сроков и новая архитектура

На конференции Huawei Connect компания представила обновленный план развития AI-ускорителей. Ключевое изменение — ускорение выхода поколения Ascend 960: чипы теперь появятся на рынке в 2027 году, что на несколько кварталов раньше первоначальных планов. Huawei официально переходит от устаревшей архитектуры SIMD к гибридной SIMD+SIMT, объединяющей векторную обработку и потоковый параллелизм для повышения эффективности при работе с разными типами нейросетевых нагрузок.

Технические характеристики Ascend 960

Линейка Ascend 960 разделена на две модификации: 960DT (для обучения) и 960PR (для префиллинга и рекомендаций). Особое внимание уделено производительности в низкоточных форматах, критичных для инференса. Производительность Ascend 960PR в формате FP4 удвоилась по сравнению с предыдущими оценками, что свидетельствует о серьезной переработке вычислительных блоков.

Модель Релиз FP8 (PFLOPS) FP4 (PFLOPS) Память Пропускная способность памяти Интерконнект
Ascend 960DT 2027 Q1 2 4 288 GB 9.6 TB/s 2.2 TB/s
Ascend 960PR 2027 Q3 2 8 192 GB 2.4 TB/s 2.2 TB/s
Ascend 970 2028 3.6 14 288 GB 14.4 TB/s 4.4 TB/s
Ascend 980 2029 7.2* 28* 384 GB 38.4 TB/s* 8 TB/s*

Контекст и сравнение с NVIDIA

Несмотря на амбициозные цифры, Huawei все еще отстает от лидера рынка. Для сравнения: GPU NVIDIA VR200 (ожидаемый релиз Q4 2026) заявляет 50 NVFP4 PFLOPS для инференса и 288 GB памяти HBM4. Кроме того, текущие системы Atlas 950 SuperPoD сталкиваются с проблемами масштабирования: максимальная конфигурация (8192 ускорителей) пока не достигнута, а коммерческое развертывание идет медленнее из-за нехватки мощностей и необходимости переработки ПО.

Стратегия на 2028–2029 годы

Следующие поколения, Ascend 970 и 980, будут выпускаться ежегодно. Huawei заявляет о применении закона масштабирования Tau (τ), который обеспечит двукратный рост вычислительных мощностей и пропускной способности памяти с каждым поколением. Ascend 980 (2029) обещает 28 PFLOPS в FP4, что сделает его серьезным конкурентом в сегменте высокопроизводительных AI-кластеров.

Источник: Tom's Hardware ↗