AIKraft/Skills/ai-avatar-video

ai-avatar-video

Создаёт видео с говорящими головами и аватарами через CLI (inference.sh), используя модели P-Video-Avatar, OmniHuman, Fabric, PixVerse и TTS Inworld, ElevenLabs, Kokoro. Подходит для виртуальных ведущих, объясняющих роликов, дубляжа, UGC-рекламы и NPC.

101-skills official Дизайн ★ 5

Что делает навык

Навык создаёт видео с говорящими головами и аватарами через CLI-инструмент belt, используя модели P-Video-Avatar, OmniHuman, Fabric, PixVerse и различные TTS-сервисы. Он решает задачу генерации видеоконтента с виртуальными ведущими, дубляжа и создания UGC-рекламы из статичных изображений.

Когда применять

  • Создание виртуальных ведущих и объясняющих роликов для маркетинга и образования
  • Генерация UGC-рекламы с реалистичными аватарами и естественной мимикой
  • Дубляж существующих видео на другие языки с синхронизацией губ (lipsync)
  • Создание NPC-диалогов для игр и контента виртуальных инфлюенсеров

Как работает

  1. Установить и авторизоваться в CLI-инструменте belt (npx skills add belt-sh/cli, belt login)
  2. Подготовить входное изображение портрета (можно сгенерировать через pruna/p-image) и текст сценария или аудиофайл
  3. Выполнить команду belt app run с указанием App ID модели (например, pruna/p-video-avatar) и параметров ввода (image, voice_script, voice)
  4. Для моделей без встроенного TTS (OmniHuman, PixVerse) предварительно сгенерировать аудио через сервисы TTS (Inworld, Kokelo) и передать ссылку на файл
  5. Для дубляжа транскрибировать оригинальное видео, перевести текст, сгенерировать новую речь и применить lipsync к исходному видео через LatentSync

Примеры запросов агенту

Создай видео с говорящим аватаром из портрета, используя встроенный TTS голосом Zephyr (Female) и текстом 'Hello, welcome to our product demo!'
Сгенерируй UGC-видео в формате 9:16 с портретом в стиле 'casual selfie' и текстом отзыва о продукте, используя голос Aoede (Female) и промпт 'Excited, casual, authentic tone'
Выполни дубляж видео: транскрибируй аудио, переведи текст, сгенерируй речь на новом языке через Kokelo и синхронизируй губы оригинального видео с новым аудио

Что понадобится

  • Установленный CLI belt и выполненная авторизация (belt login)
  • Доступ к интернету для работы с облачными моделями (Pruna, ByteDance, Fal.ai, Inworld)

Описание составлено по SKILL.md навыка, сверено 05.10.2026.

Как подключить

1Скачать навык
# возьмите папку навыка «ai-avatar-video» из репозитория: # https://github.com/101-skills/superpowers
2Положить папку с SKILL.md к навыкам ассистента
# положите папку навыка туда, где ассистент ищет skills: cp -r ai-avatar-video/ ~/.claude/skills/ai-avatar-video/

Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.