Tencent-Hunyuan/HunyuanVideo-I2V

HunyuanVideo-I2V: настраиваемая модель преобразования изображения в видео на базе HunyuanVideo

Видео⭐ 1 843Python
Открыть на GitHub ↗Сайт проекта ↗

Что это за инструмент

HunyuanVideo-I2V — это модель генерации видео на основе изображений (Image-to-Video), разработанная Tencent, являющаяся специализированной версией HunyuanVideo.

Зачем нужен

Инструмент позволяет создавать видео, сохраняя визуальное сходство первого кадра с исходным изображением. Он полезен для задач, где критична точность передачи начального образа, и поддерживает кастомизацию эффектов через обучение LoRA.

Что можно реализовать

  • Генерация видео с полным сохранением идентичности персонажа или объекта на первом кадре
  • Создание анимации с использованием пользовательских эффектов (LoRA), таких как рост волос или объятия
  • Ускорение инференса на нескольких GPU с помощью параллельных вычислений (xDiT)
  • Интеграция в рабочие процессы через ComfyUI для расширенной обработки видео

Ключевые возможности

  • Высокое качество согласованности первого кадра (First Frame Consistency)
  • Поддержка обучения и инференса LoRA для кастомных визуальных эффектов
  • Наличие кода для параллельного инференса (xDiT) для ускорения работы
  • Официальная поддержка ComfyUI и доступность весов на HuggingFace
  • Исправление багов, влиявших на изменение идентичности (ID) в предыдущих версиях

👤 Кому подойдёт: разработчики, исследователи, создатели контента, использующие open-source модели для генерации видео

Релизы

Релизы ещё не отслежены — появятся после ближайшего опроса.