VLM

Реализация возможностей чата на основе компьютерного зрения с использованием z-ai-web-dev-sdk. Использовать этот навык, когда пользователю нужно проанализировать изображения, описать визуальное содержимое или создать приложения, сочетающие понимание изображений с диалоговым ИИ. Поддерживает URL-адреса изображений и изображения в формате base64 для мультимодального взаимодействия.

answerzhao official Дизайн

Что делает навык

Реализация возможностей чата на основе компьютерного зрения с использованием z-ai-web-dev-sdk. Использовать этот навык, когда пользователю нужно проанализировать изображения, описать визуальное содержимое или создать приложения, сочетающие понимание изображений с диалоговым ИИ. Поддерживает URL-адреса изображений и изображения в формате base64 для мультимодального взаимодействия.

Как подключить

1Скачать навык
# возьмите папку навыка «vlm» из репозитория: # https://github.com/answerzhao/agent-skills
2Положить папку с SKILL.md к навыкам ассистента
# положите папку навыка туда, где ассистент ищет skills: cp -r vlm/ ~/.claude/skills/vlm/

Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.