turboquant-pytorch
PyTorch-реализация TurboQuant для сжатия KV-кэша LLM с помощью двухэтапной векторной квантования (случайная ротация, Lloyd-Max, коррекция остатков QJL). Полезно для оптимизации памяти при работе с большими языковыми моделями.
AIreason-machines
official
Разработка
★ 83
Что делает навык
PyTorch-реализация TurboQuant для сжатия KV-кэша LLM с помощью двухэтапной векторной квантования (случайная ротация, Lloyd-Max, коррекция остатков QJL). Полезно для оптимизации памяти при работе с большими языковыми моделями.
Как подключить
1Скачать навык
# возьмите папку навыка «turboquant-pytorch» из репозитория:
# https://github.com/reason-machines/trending-skills
2Положить папку с
SKILL.md к навыкам ассистента# положите папку навыка туда, где ассистент ищет skills:
cp -r turboquant-pytorch/ ~/.claude/skills/turboquant-pytorch/
Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.