Новая спецификация ACEv1
Группа x86 Ecosystem Advisory Group, возглавляемая Intel и AMD, утвердила спецификацию AI Compute Extensions (ACE) v1. Это кросс-вендорное расширение становится преемником технологии Intel Advanced Matrix Extensions (AMX). Главная цель ACE — оптимизация x86-архитектуры для задач машинного обучения, в частности, для операций с матрицами.
Технические детали и интеграция с AVX
ACEv1 не заменяет, а дополняет существующие векторные расширения. Ключевые нововведения включают:
- Новое состояние регистров: добавлены регистры тайлов (tile) и блочных масштабов (block scale).
- Обработка данных: операции, потребляющие входные данные из регистров AVX и работающие с состоянием регистров ACE.
- Перемещение данных: механизмы для передачи данных между состоянием ACE и регистрами AVX.
- Управление системой: новые состояния и операции для системного менеджмента.
Архитектура обеспечивает тесную интеграцию векторов AVX и тайловых регистров ACE, сочетая высокую плотность вычислений с широкими возможностями обработки данных AVX.
Патчи для GCC
Инженеры Intel опубликовали начальные патчи для GNU Compiler Collection (GCC), чтобы подготовить компилятор к поддержке ACE. Разработка базируется на существующем коде AMX-TILE и элементах AVX-512. Патчи уже доступны в списке рассылки GCC patches mailing list.
Планы и сроки
Ожидается, что поддержка ACEv1 будет включена в стабильный релиз GCC 17, который запланирован на следующий год. Это позволит разработчикам начать оптимизацию кода под новые процессоры заранее.
| Характеристика | AMX (текущее поколение) | ACE (новое поколение) |
|---|---|---|
| Статус | Действующая технология | Утвержденная спецификация v1 |
| Разработчик | Intel | Intel + AMD (x86 Ecosystem Advisory Group) |
| Основа для GCC | AMX-TILE | AMX-TILE + AVX-512 элементы |
| Целевая версия GCC | — | GCC 17 (ожидаемый релиз) |
Почему это важно
Переход к ACE标志着 x86-экосистема движется к единому стандарту ускорения ИИ-вычислений, что упростит разработку кросс-платформенных решений. Публикация патчей GCC — первый шаг к тому, чтобы программисты могли использовать новые возможности железа уже в следующем году.
Источник: Phoronix ↗
