hpcaitech/Open-Sora

Open-Sora: демократизация эффективного производства видео для всех

Видео⭐ 29 819Pythonпоследний релиз: v1.3
Открыть на GitHub ↗Сайт проекта ↗

Что это за инструмент

Open-Sora — это open-source платформа для генерации видео, обеспечивающая полный цикл от предобработки данных до обучения и инференса моделей.

Зачем нужен

Инструмент решает задачу демократизации создания видео, предлагая эффективные и доступные решения для генерации контента. Он полезен тем, кто хочет обучать собственные модели видео-генерации с существенно сниженными затратами (включая поддержку GPU-ваучеров и оптимизацию через ColossalAI), не прибегая к закрытым коммерческим API.

Что можно реализовать

  • Обучение моделей текстовой генерации видео (text-to-video) с нуля или дообучение существующих
  • Генерация видео по изображению (image-to-video) и видео по видео (video-to-video)
  • Создание анимаций с поддержкой произвольных соотношений сторон и длительности от 2 до 15 секунд
  • Исследование архитектуры видео-генерации с использованием 3D-VAE и rectified flow
  • Разработка собственных решений для видеопроизводства с полным контролем над кодом и весами

Ключевые возможности

  • Полный open-source стек: доступны чекпоинты (включая модель 2.0 на 11B параметров) и код для обучения
  • Поддержка различных режимов генерации: text-to-image, text-to-video, image-to-video, video-to-video
  • Высокая эффективность: заявлено снижение стоимости разработки на 50% и возможность обучения за 3 дня на 3 днях
  • Гибкость параметров: поддержка разрешений от 144p до 720p и любых соотношений сторон
  • Интеграция с фреймворком ColossalAI для ускорения обучения и инференса

👤 Кому подойдёт: разработчики, исследователи в области AI, инженеры машинного обучения, компании, разрабатывающие собственные решения для генерации контента

Релизы

v1.3major
🕐 19 мес назад · релиз на GitHub ↗

Open-Sora v1.3: улучшена архитектура ST-DiT, сжатие видео и качество генерации, поддержка image-to-video.

  • Added: Обновлена архитектура ST-DiT для повышения качества генерации.
  • Added: Улучшено сжатие видео и добавлены высококачественные данные.
  • Added: Внедрено многоэтапное обучение и продвинутое условное моделирование.
  • Added: Расширена поддержка разрешения и длины кадров для image-to-video.