AIKraft/Skills/ai-avatar-video

ai-avatar-video

Создаёт видео с говорящими головами и аватарами через CLI (inference.sh). Поддерживает P-Video-Avatar, OmniHuman, Inworld TTS-2, ElevenLabs. Подходит для виртуальных ведущих, объясняющих роликов, дубляжа и UGC-контента.

qu-skills official Дизайн ★ 2

Что делает навык

Skill создает видео с говорящими головами и аватарами через CLI-инструмент belt, используя модели P-Video-Avatar, OmniHuman, Fabric и PixVerse. Он решает задачу генерации виртуальных ведущих, объясняющих роликов и дубляжа, объединяя генерацию изображения, синтеза речи и анимации лица.

Когда применять

  • Создание UGC-контента и рекламных роликов с виртуальными презентерами
  • Генерация обучающих видео и объясняющих роликов (explainers)
  • Локализация и дубляж существующих видео на другие языки
  • Создание контента для социальных сетей с виртуальными инфлюенсерами
  • Генерация диалогов для игровых персонажей (NPC)

Как работает

  1. Установить CLI-инструмент belt и выполнить авторизацию командой belt login
  2. Сгенерировать портретное изображение с помощью pruna/p-image (опционально, если нет готового фото)
  3. Запустить модель P-Video-Avatar с указанием изображения, текстового скрипта и голоса для синтеза речи и анимации
  4. Для моделей без встроенного TTS (OmniHuman, PixVerse) предварительно сгенерировать аудио через Inworld TTS-2 или Kokoro TTS
  5. Для дубляжа транскрибировать оригинальное видео, перевести текст, сгенерировать новую речь и применить LatentSync для синхронизации губ

Примеры запросов агенту

Создай видео с говорящим аватаром на основе портрета, используя встроенный синтез речи для текста 'Привет, добро пожаловать на демо продукта' с голосом Zephyr (Female).
Сгенерируй UGC-ролик: сначала создай портрет в стиле селфи, затем запиши видео с аватаром, который рассказывает о продукте в неформальном тоне.
Выполни дубляж видео: транскрибируй аудио, переведи текст на другой язык, сгенерируй новую речь и синхронизируй её с оригинальным видео через LatentSync.

Что понадобится

  • Установленный и авторизованный CLI belt (belt login)
  • Доступ к интернету для работы с API Pruna, ByteDance, Fal.ai и других провайдеров
  • Качественные портретные изображения (лицом к камере, хорошее освещение) для входных данных

Описание составлено по SKILL.md навыка, сверено 05.10.2026.

Как подключить

1Скачать навык
# возьмите папку навыка «qu-skills-ai-avatar-video» из репозитория: # https://github.com/qu-skills/superpowers
2Положить папку с SKILL.md к навыкам ассистента
# положите папку навыка туда, где ассистент ищет skills: cp -r qu-skills-ai-avatar-video/ ~/.claude/skills/qu-skills-ai-avatar-video/

Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.