Ранний релиз перед Zen 6
8 июля 2026 года AMD выпустила версию 6.0 своей библиотеки глубоких нейронных сетей ZenDNN. Это значимое обновление, которое служит альтернативой библиотеке Intel oneDNN (UXL Foundation). ZenDNN оптимизирована для процессоров AMD Zen (от Ryzen до EPYC) и работает через плагины с популярными фреймворками TensorFlow и PyTorch. Примечательно, что релиз состоялся до официального дебюта архитектуры Zen 6, что позволяет разработчикам начать оптимизацию кода заранее.
Ключевые технические улучшения
В версии 6.0 сосредоточено внимание на нескольких критических аспектах производительности инференса:
- Low Overhead API (LowOHA): расширены возможности API с низким уровнем накладных расходов, что снижает задержки при вызовах операций.
- MoE Group GEMM: улучшена поддержка групповых операций умножения матриц (GEMM) для моделей с экспертами (Mixture of Experts), что критично для современных LLM.
- FP16 операторы: расширено покрытие операций с плавающей точкой двойной точности (FP16), повышая эффективность вычислений.
- Кэширование: внедрено кэширование пост-операций (post-op) и весов (weight caching), что ускоряет повторные запуски моделей.
Значение для экосистемы
Выпуск ZenDNN 6.0 до появления новых процессоров подчеркивает стратегию AMD по обеспечению программного превосходства. Для пользователей Ryzen и EPYC это означает возможность получить прирост производительности в задачах AI/ML уже на текущем оборудовании, без необходимости аппаратного апгрейда. Библиотека доступна для загрузки через GitHub.
Источник: Phoronix ↗
