Прорыв в генеративном видео
Компания Meta официально представила обновленную версию своей модели генерации видео — Sonnet 5. Это не просто итеративное обновление, а значительный скачок в качестве визуального контента, создаваемого искусственным интеллектом. Модель демонстрирует способность создавать более длинные и сложные сцены с сохранением консистентности персонажей и объектов.
Ключевые улучшения
В отличие от предыдущих версий, Sonnet 5 значительно лучше справляется с:
- Физикой движения: Объекты ведут себя более реалистично, уменьшая артефакты «плавления» или искажения форм.
- Кинематографичностью: Улучшено освещение, глубина резкости и цветовая палитра, что делает видео похожими на профессиональную съемку.
- Пониманием промптов: Модель точнее интерпретирует сложные текстовые описания, включая специфические ракурсы и движения камеры.
Сравнение с предыдущими версиями
Аналитики отмечают существенный прогресс по сравнению с Sonnet 4. Ниже приведена таблица ключевых метрик улучшения:
| Характеристика | Sonnet 4 | Sonnet 5 |
|---|---|---|
| Стабильность объектов | Средняя | Высокая |
| Длина генерации (сек) | До 5 | До 10 |
| Кинематографичность (оценка) | 3.5/5 | 4.8/5 |
| Сложность сцен | Простая | Средняя/Сложная |
Значение для индустрии
Выход Sonnet 5 ставит Meta в один ряд с лидерами рынка генеративного видео, такими как Runway и Pika. Для создателей контента, маркетологов и разработчиков игр это означает возможность создания прототипов и финальных ассетов с меньшими затратами времени и ресурсов. Модель доступна для тестирования через API, что открывает новые возможности для интеграции в рабочие процессы.
Источник: Towards AI pub ↗
