🎬 Alibaba представила AVA-Encoder: фильм превращается в текстовый граф знаний
Qwen Business Unit Alibaba переводит фильм в текстовый «Film Knowledge Graph» — иерархию Story–Event–Shot с узлами персонажей, сцен, стиля и камеры, — и восстанавливает видео из графа фиксированным декодером. Ошибка реконструкции обучает энкодер в двухцикловом самообучающемся контуре.
🌍 Для видео-агентов это строгая метрика сохранённой кинематографической информации и самообучающийся цикл без обновления весов foundation-моделей. В бенчмарке — 49.0% фидельности против 28.3% у внешнего бейслайна; выпущен первый датасет Film KG на десятки тысяч шотов.
👤 Механизм «видео → редактируемый граф → видео»: смена персонажа, стиля или освещения обновляет зависимые элементы по связям. Код и промпты в репозиторий ещё не легли — запустить пока нечем.
Источник 1: https://arxiv.org/abs/2608.12313 Источник 2: https://ava-encoder.github.io/
