dflash-mlx-speculative-decoding
Беспотерное спекулятивное декодирование DFlash для MLX на Apple Silicon. Ускоряет инференс LLM в 1.7–4 раза за счет блочного диффузионного черновика и верификации целевой моделью.
AIreason-machines
official
Разработка
★ 83
Что делает навык
Беспотерное спекулятивное декодирование DFlash для MLX на Apple Silicon. Ускоряет инференс LLM в 1.7–4 раза за счет блочного диффузионного черновика и верификации целевой моделью.
Как подключить
1Скачать навык
# возьмите папку навыка «dflash-mlx-speculative-decoding» из репозитория:
# https://github.com/reason-machines/trending-skills
2Положить папку с
SKILL.md к навыкам ассистента# положите папку навыка туда, где ассистент ищет skills:
cp -r dflash-mlx-speculative-decoding/ ~/.claude/skills/dflash-mlx-speculative-decoding/
Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.