Стартап Odyssey, основанный выходцами из разработки беспилотных автомобилей Оливером Кэмероном и Джеффом Хоуком, 8 октября 2026 года выпустил фундаментальную модель мира Odyssey-3. По текстовому запросу она генерирует интерактивное окружение и в реальном времени просчитывает, как в нём двигаются и взаимодействуют объекты. На бенчмарке Physics-IQ Verified версия Odyssey-3 Pro набрала 66,1 балла — лучший опубликованный результат, впереди моделей NVIDIA Cosmos3, FLUX 3, Seedance 2.5, Veo 3.1 и Sora 2. Интерактивный превью-режим уже открыт бесплатно в браузере, а доступ к API выдаётся по заявке.

image
image
image

Что произошло

Odyssey-3 вышла сразу в двух версиях: базовая с разрешением 832×480 и Odyssey-3 Pro со 1280×720. Довести авторегрессионный диффузионный трансформер до ответа в реальном времени позволила дистилляция до нескольких шагов генерации с использованием distribution-matching и adversarial distillation. Внутри сгенерированного мира поддерживаются перемещение от первого и третьего лица, отдельное от перемещения управление камерой и добавление событий прямо во время генерации. На бенчмарке Physics-IQ Verified от Anates Labs и DeepMind Odyssey-3 Pro набрала 66,1 балла в режиме video-to-video по протоколу best-of-8 — это лучший опубликованный результат: в таблице модель стоит впереди NVIDIA Cosmos3-Super и Cosmos3-Nano, FLUX 3, Seedance 2.5, Veo 3.1 и Sora 2. На бенчмарке WorldMark модель заняла первые места в трёх категориях из четырёх: First-Person Stylized 77,2, Third-Person Real 79,0 и Third-Person Stylized 76,3. Одновременно с анонсом открылись бесплатный интерактивный превью-режим в браузере и приём заявок на доступ к API.

Контекст

Odyssey основали Оливер Кэмерон и Джефф Хоук, ранее работавшие над беспилотными автомобилями, поэтому заявка на универсальный генеративный симулятор продолжает их экспертизу. Фундаментальная модель мира — это общая среда, на базе которой можно обучать разные политики для роботов, гуманоидов и автомобилей, вместо сборки частного симулятора под каждый домен, как это сегодня происходит с CARLA в автономности. Ключевой инженерный сдвиг здесь не качество отдельного кадра, а латентность: покадровая авторегрессионная генерация, дистиллированная до нескольких шагов, превращает генератор видео в симулятор с быстрым циклом запрос-ответ, где среда сразу отвечает на действия пользователя и новые события. Понимать результат стоит в контексте уже идущей гонки world models: модели этого класса строят NVIDIA с линейкой Cosmos3 и лаборатории видео-моделей, так что окно единоличного лидерства Odyssey-3 вряд ли окажется долгим.

Почему это важно для индустрии

Для компаний, строящих физический ИИ, Odyssey-3 — заявка на замену набора частных симуляторов одним замороженным бэкбоном. Odyssey демонстрирует обучение поверх модели декодеров действий для роборуки на десятках часов демонстраций, политик для гуманоидов Flexion и, по заявлению компании, вождение реального автомобиля в Индии на всего 20 часах данных, причём поведение роборуки в демонастрации отсутствовало в обучающих данных. Если эти sim-to-real кейсы подтвердятся независимой проверкой, подход «одна модель мира на все домены» станет рабочим, а собранные вручную симуляторы вроде CARLA рискуют превратиться в нишевый fallback. Практические точки входа уже открыты: бесплатное браузерное превью позволяет за день прогнать критичные для команды сценарии и сравнить Odyssey-3 Pro в том числе с Cosmos3 и собственным текущим симулятором, а доступ к API выдаётся по заявке через developer.odyssey.ml. При этом цену API не объявили, метрики латентности и SLA отсутствуют, поэтому закладывать модель в продакшн пока можно только как эксперимент, а готовых продуктов на базе Odyssey-3 в источниках не появилось вовсе.

Почему это важно для пользователей

Главное для читателя — бесплатный интерактивный превью-режим на experience.odyssey.systems. Мир генерируется по текстовому запросу, по нему можно ходить от первого или третьего лица, камера управляется отдельно от перемещения, а события добавляются на ходу — так видно, как модель просчитывает «физику» в реальном времени, а не показывает заранее просчитанную нарезку кадров. Это возможность вручную проверить, где генеративная симуляция ведёт себя убедительно, а где начинает ошибаться: то, что раньше требовало развёртывания собственного стенда, сегодня открывается прямо в браузере. Разработчики и команды с физическими ИИ-проектами могут параллельно подать заявку на API через developer.odyssey.ml. Готовых потребительских продуктов на базе Odyssey-3 в источниках пока нет, поэтому на сегодня это прежде всего бесплатный способ самому почувствовать, как выглядит интерактивный генеративный мир.

Что пока неизвестно / ограничения

Часть заявлений пока опирается только на данные самой Odyssey. Результат 66,1 на Physics-IQ Verified получен по протоколу best-of-8, где оценка берётся по лучшей из нескольких попыток, и корректность сравнения с другими моделями зависит от идентичности условий оценивания. На WorldMark модель уступила в реалистичных сценах от первого лица Lyra 2.0 с 84,4 балла и AlayaWorld — сильные стороны Odyssey-3 лежат в управляемости и стилизации, а не в чистой фотометрической реалистичности. Технический отчёт с методологией и абляциями на момент публикации не вышел, независимых воспроизведений sim-to-real кейсов — роборуки, гуманоидов Flexion, езды в Индии — также нет. Цена API, метрики латентности и SLA не объявлены, поэтому любые продуктовые планы вокруг модели преждевременны.

Источники

Автор

Look at AI, редакция