Tencent-Hunyuan/HunyuanVideo

HunyuanVideo: системный подход к созданию больших моделей генерации видео

Видео⭐ 12 550Pythonпоследний релиз: HunyuanVideo
Открыть на GitHub ↗Сайт проекта ↗

Что это за инструмент

HunyuanVideo — это большая модель для генерации видео, представляющая собой системный фреймворк от Tencent с открытым исходным кодом.

Зачем нужен

Инструмент предназначен для создания видеоконтента на основе текстовых описаний (text-to-video). Он полезен благодаря открытости весов, интеграции с библиотекой Diffusers и наличию оптимизированных версий (например, FP8) для снижения требований к GPU.

Что можно реализовать

  • Генерация видео по текстовому промпту (text-to-video)
  • Создание видео на основе входного изображения (image-to-video)
  • Анимация персонажей на основе аудиодорожки (audio-driven human animation)
  • Кастомизация видео с использованием мультимодальных данных (HunyuanCustom)
  • Ускорение генерации с помощью техник дистилляции (FastVideo) или кэширования (TeaCache)

Ключевые возможности

  • Полная открытость: доступны PyTorch-модели, веса и код инференса
  • Поддержка различных режимов: T2V, I2V, Avatar и кастомизация
  • Оптимизация ресурсов: наличие FP8-весов и версий для слабых GPU (HunyuanVideoGP)
  • Интеграция с экосистемой: поддержка в Diffusers, ComfyUI и Replicate
  • Параллельный инференс: поддержка xDiT для ускорения работы на кластерах

👤 Кому подойдёт: разработчики, исследователи в области AI, инженеры по машинному обучению, создатели контента, использующие open-source решения

Релизы