Компания ByteDance представила Seedance 2.5 — революционную модель генерации видео, способную создавать непрерывные 30-секундные ролики в разрешении 4K за один цикл обработки. Благодаря использованию архитектуры Sparse Diffusion Transformer, новая модель решает критическую проблему «дрейфа» персонажей и освещения, обеспечивая беспрецедентную стабильность длинных сцен.

image
image

Что произошло

ByteDance представила Seedance 2.5, которая позволяет генерировать полноценные 30-секундные видео в формате 4K в один проход (single-pass). Модель поддерживает до 50 мультимодальных референсов, включая изображения, видео, аудио, текст и даже 3D-модели, что обеспечивает глубокий контроль над создаваемым контентом.

Контекст

До появления Seedance 2.5 индустрия была сосредоточена на генерации коротких фрагментов, которые требовали последующей склейки и интерполяции. Текущие лидеры рынка, такие как Kling и Google Veo, сталкиваются с ограничениями в области временной связности (temporal coherence) при попытке создания длинных последовательных сцен.

Почему это важно для индустрии

Переход от генерации отдельных клипов к созданию цельных 30-секундных сцен радикально меняет пайплайны видеопроизводства, минимизируя потребность в ручной постобработке. Это создает давление на стартапы, специализирующиеся на инструментах автоматизированного монтажа, и устанавливает новые стандарты управления генеративными параметрами в видеопроизводстве.

Почему это важно для пользователей

Создатели контента получают возможность генерировать сложные и длинные видеоролики с сохранением внешности персонажей и стабильностью окружения всего с помощью одного запроса. Поддержка 3D-моделей и аудио в качестве референсов открывает путь к созданию высококачественного AI-driven видео с беспрецедентным уровнем точности.

Что пока неизвестно / ограничения

Несмотря на технологический прорыв, эксперты указывают на серьезные юридические риски, связанные с авторским правом, которые могут затруднить коммерческое внедрение технологии в профессиональный продакшн.

Источники

Автор

Look at AI, редакция