llama-cpp
Выполняет инференс LLM на CPU, Apple Silicon и потребительских GPU без NVIDIA. Подходит для edge-деплоя, Mac M1-M3, AMD/Intel GPU или при отсутствии CUDA. Поддерживает GGUF-квантование (1.5-8 бит) для ускорения в 4-10 раз.
AIdavila7
official
Разработка
★ 32.5k
Что делает навык
Выполняет инференс LLM на CPU, Apple Silicon и потребительских GPU без NVIDIA. Подходит для edge-деплоя, Mac M1-M3, AMD/Intel GPU или при отсутствии CUDA. Поддерживает GGUF-квантование (1.5-8 бит) для ускорения в 4-10 раз.
Как подключить
1Скачать навык
# возьмите папку навыка «davila7-llama-cpp» из репозитория:
# https://github.com/davila7/claude-code-templates
2Положить папку с
SKILL.md к навыкам ассистента# положите папку навыка туда, где ассистент ищет skills:
cp -r davila7-llama-cpp/ ~/.claude/skills/davila7-llama-cpp/
Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.