Отладка модели
Debug silent corruption when a MAX model loads, compiles, serves, and generates tokens but output disagrees with a reference implementation. Use whenever parity debugging stalls on scalar taps, the model returns gibberish or wrong greedy tokens, logit cosine is high but argmax differs, or generation is coherent then diverges â during an architecture port, a quantization bring-up, a multi-GPU con
Что делает навык
Настройка протокола отладки паритета (parity) и согласованности (coherence) для моделей, работающих без ошибок, но выдающих неверный вывод. Позволяет выявлять направленные ошибки, скрываемые скалярными отладочными выводами, путем сравнения тензоров MAX с эталонной реализацией PyTorch.
Когда применять
- Портирование пользовательской архитектуры, которая обслуживает запросы, но не проходит проверки паритета или согласованности.
- Отладка квантованной версии модели, основанной на ранее работавшем порте.
- Конвертация рабочей модели с одного GPU на несколько GPU (multi-GPU).
- Восстановление работоспособности после регрессии, возникшей после обновления MAX.
Как работает
- Создать компаратор дампов тензоров по слоям (per-layer tensor-dump comparator).
- Использовать этот компаратор для получения данных в виде чтения numpy из диска, избегая скалярных ops.print и перекомпиляции циклов.
- Запустить модель MAX и эталонную реализацию PyTorch с возможностью хуков (hook).
- Сравнить выходные данные MAX с эталонным выводом PyTorch для выявления расхождений.
Примеры запросов агенту
Что понадобится
- Доступ к эталонной реализации PyTorch, которую можно запустить и хуковать.
- Среда выполнения MAX.
Описание составлено по SKILL.md навыка, сверено 05.10.2026.
Как подключить
SKILL.md к навыкам ассистентаНавык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.