eval
Оценка и ранжирование результатов работы агентов по метрике или оценке LLM-судьи для сессии AgentHub. Используйте, когда пользователь запускает /hub:eval или просит оценить, сравнить или выбрать победителя среди завершенных агентов AgentHub.
AIalirezarezvani
official
Другое
Что делает навык
Оценка и ранжирование результатов работы агентов по метрике или оценке LLM-судьи для сессии AgentHub. Используйте, когда пользователь запускает /hub:eval или просит оценить, сравнить или выбрать победителя среди завершенных агентов AgentHub.
Как подключить
1Скачать навык
# возьмите папку навыка «eval» из репозитория:
# https://github.com/alirezarezvani/claude-skills
2Положить папку с
SKILL.md к навыкам ассистента# положите папку навыка туда, где ассистент ищет skills:
cp -r eval/ ~/.claude/skills/eval/
Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.