AIKraft/Skills/verl-rl-training

verl-rl-training

Предоставляет рекомендации по обучению больших языковых моделей (LLM) с использованием обучения с подкреплением (RL) через verl (Volcano Engine RL). Применяется при реализации RLHF, GRPO, PPO или других алгоритмов RL для постобучения LLM в масштабе с использованием гибких бэкендов инфраструктуры.

orchestra-research official Другое

Что делает навык

Предоставляет рекомендации по обучению больших языковых моделей (LLM) с использованием обучения с подкреплением (RL) через verl (Volcano Engine RL). Применяется при реализации RLHF, GRPO, PPO или других алгоритмов RL для постобучения LLM в масштабе с использованием гибких бэкендов инфраструктуры.

Как подключить

1Скачать навык
# возьмите папку навыка «verl-rl-training» из репозитория: # https://github.com/orchestra-research/ai-research-skills
2Положить папку с SKILL.md к навыкам ассистента
# положите папку навыка туда, где ассистент ищет skills: cp -r verl-rl-training/ ~/.claude/skills/verl-rl-training/

Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.