К содержанию
Новости

ByteDance представила в Китае видеомодель Seedance 2.5 с генерацией роликов до 30 секунд

ByteDance представила в Китае видеомодель Seedance 2.5 с генерацией роликов до 30 секунд

ByteDance объявила о запуске в Китае модели для генерации видео Seedance 2.5. Как пишет IT Home, она постепенно появится в сервисах Jimeng AI и Doubao Professional Edition, а API в ближайшее время подключат к Volcano Ark. В компании говорят, что модель построена на той же мультимодальной архитектуре совместной генерации аудио и видео, что и Seedance 2.0, но получила улучшения для длинных сюжетов, работы с референсами и редактирования.

Seedance 2.5 за один запуск может создавать ролики длительностью до 30 секунд, тогда как предыдущая версия ограничивалась 15 секундами. Кроме того, модель поддерживает многоэтапное продление видео. По словам ByteDance, система умеет выстраивать последовательность связанных сцен с развитием сюжета, включая вступление, развитие и завершение. Среди демонстраций показали непрерывную сцену выступления певицы и эпизод с мальчиком в метро. При продолжении генерации сохранялись персонажи, стиль изображения, сцена и звук.

Модель поддерживает загрузку до 30 изображений, 10 видео и 10 аудиофрагментов в качестве референсов для одного запроса. ByteDance утверждает, что Seedance 2.5 учитывает композицию кадра, стиль, персонажей, реквизит и другие элементы из разных материалов. Также заявлена поддержка сцен с несколькими персонажами и групповых эпизодов, где сохраняются внешность и голоса героев.

Ключевые факты

  • Seedance 2.5 ориентирована на сценарии в кино, рекламе, образовании, промышленности, embodied AI и автономном вождении

  • Модель поддерживает многоэтапное продление видео с сохранением сцены, персонажей, визуального стиля и звука

  • Для одного запроса можно использовать до 30 изображений, 10 видео и 10 аудиофрагментов

  • В демонстрации с концертной сценой использовался формат 16:9 и кинематографический реалистичный стиль

Вопросы и ответы

Что именно улучшили по сравнению с Seedance 2.0 для длинных видео и сериализованных сцен?

Seedance 2.5 генерирует ролики до 30 секунд за один запуск вместо 15 секунд у предыдущей версии и поддерживает многоэтапное продление видео. При продолжении генерации модель сохраняет персонажей, сцену, визуальный стиль и звук между связанными эпизодами.

Насколько гибко модель работает с референсами и исходными материалами?

Для одного запроса можно загрузить до 30 изображений, 10 видео и 10 аудиофрагментов. Модель учитывает композицию кадра, стиль, персонажей и реквизит из разных материалов, а также поддерживает сцены с несколькими героями и сохранением их внешности и голосов.

Где и для каких сценариев Seedance 2.5 будет доступна бизнесу?

ByteDance заявляет сценарии использования для кино, рекламы, образования, промышленности, embodied AI и автономного вождения. Модель постепенно появится в Jimeng AI и Doubao Professional Edition, а API в ближайшее время подключат к платформе Volcano Ark.

Контекст по теме