AIKraft/Skills/turboquant-pytorch

turboquant-pytorch

PyTorch-реализация TurboQuant для сжатия KV-кэша LLM с помощью двухэтапной векторной квантования (случайная ротация, Lloyd-Max, коррекция остатков QJL). Полезно для оптимизации памяти при работе с большими языковыми моделями.

reason-machines official Разработка ★ 83

Что делает навык

PyTorch-реализация TurboQuant для сжатия KV-кэша LLM с помощью двухэтапной векторной квантования (случайная ротация, Lloyd-Max, коррекция остатков QJL). Полезно для оптимизации памяти при работе с большими языковыми моделями.

Как подключить

1Скачать навык
# возьмите папку навыка «turboquant-pytorch» из репозитория: # https://github.com/reason-machines/trending-skills
2Положить папку с SKILL.md к навыкам ассистента
# положите папку навыка туда, где ассистент ищет skills: cp -r turboquant-pytorch/ ~/.claude/skills/turboquant-pytorch/

Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.