🎨 World Labs показала Atlas: world model с управлением камерой

Компания Фей-Фей Ли выпустила «omni»-модель пространственного интеллекта, работающую с текстом, изображениями, видео и 3D. Она генерирует видео до 60 секунд в 1440p — геометрия камеры задаётся отдельным входом, а не текстом — и восстанавливает 3D-сцены по 2–3 и до 100+ снимкам с выдачей Gaussian splats.

🌍 Генерация видео, 3D-реконструкция и симуляция собраны в одной модели — камера превращается из побочного эффекта промпта в управляемый инструмент производства. Real-to-Sim из 24 кадров видео с телефона даёт путь к обучающим данным для роботов.

👤 Сцену можно «поставить» как в превизуализации: задать пространство, нарисовать траекторию камеры и получить согласованные кадры с любых ракурсов, включая bullet time с трёх. Ранний доступ откроется в ближайшие недели через Marble.

Источник 1: https://www.worldlabs.ai/blog/atlas