Сдвиг сроков и новая архитектура
На конференции Huawei Connect компания представила обновленный план развития AI-ускорителей. Ключевое изменение — ускорение выхода поколения Ascend 960: чипы теперь появятся на рынке в 2027 году, что на несколько кварталов раньше первоначальных планов. Huawei официально переходит от устаревшей архитектуры SIMD к гибридной SIMD+SIMT, объединяющей векторную обработку и потоковый параллелизм для повышения эффективности при работе с разными типами нейросетевых нагрузок.
Технические характеристики Ascend 960
Линейка Ascend 960 разделена на две модификации: 960DT (для обучения) и 960PR (для префиллинга и рекомендаций). Особое внимание уделено производительности в низкоточных форматах, критичных для инференса. Производительность Ascend 960PR в формате FP4 удвоилась по сравнению с предыдущими оценками, что свидетельствует о серьезной переработке вычислительных блоков.
| Модель | Релиз | FP8 (PFLOPS) | FP4 (PFLOPS) | Память | Пропускная способность памяти | Интерконнект |
|---|---|---|---|---|---|---|
| Ascend 960DT | 2027 Q1 | 2 | 4 | 288 GB | 9.6 TB/s | 2.2 TB/s |
| Ascend 960PR | 2027 Q3 | 2 | 8 | 192 GB | 2.4 TB/s | 2.2 TB/s |
| Ascend 970 | 2028 | 3.6 | 14 | 288 GB | 14.4 TB/s | 4.4 TB/s |
| Ascend 980 | 2029 | 7.2* | 28* | 384 GB | 38.4 TB/s* | 8 TB/s* |
Контекст и сравнение с NVIDIA
Несмотря на амбициозные цифры, Huawei все еще отстает от лидера рынка. Для сравнения: GPU NVIDIA VR200 (ожидаемый релиз Q4 2026) заявляет 50 NVFP4 PFLOPS для инференса и 288 GB памяти HBM4. Кроме того, текущие системы Atlas 950 SuperPoD сталкиваются с проблемами масштабирования: максимальная конфигурация (8192 ускорителей) пока не достигнута, а коммерческое развертывание идет медленнее из-за нехватки мощностей и необходимости переработки ПО.
Стратегия на 2028–2029 годы
Следующие поколения, Ascend 970 и 980, будут выпускаться ежегодно. Huawei заявляет о применении закона масштабирования Tau (τ), который обеспечит двукратный рост вычислительных мощностей и пропускной способности памяти с каждым поколением. Ascend 980 (2029) обещает 28 PFLOPS в FP4, что сделает его серьезным конкурентом в сегменте высокопроизводительных AI-кластеров.
Источник: Tom's Hardware ↗
