Новые разделы!
ИИ, квантовые вычисления и много других интересных тем

Заходите в ЦИТадель!
Век живи — век учись

Odyssey открыла публичный доступ к генеративной модели мира Odyssey-3

Компания Odyssey выпустила исследовательскую версию Odyssey-3, которая создает интерактивные окружения по текстовому описанию и моделирует их изменение с учетом действий пользователя. Веб-демо работает на ускоренной версии Flash, а доступ к API предоставляется разработчикам по заявке.

Разработчик ИИ-моделей Odyssey представил Odyssey-3 — модель мира для генерации интерактивных окружений и прогнозирования их динамики. Пользователь задает сцену текстом, после чего может перемещаться по ней от первого или третьего лица, управлять камерой и запускать события: система достраивает следующие кадры в реальном времени с учетом этих действий.

Odyssey-3 реализована как авторегрессионный диффузионный трансформер. При обучении использовались интернет-видео с разметкой событий, записи игр с синхронизированными действиями клавиатуры и мыши, а также симуляции взаимодействия твердых тел. В публичном веб-демо доступна дистиллированная версия Odyssey-3 Flash; доступ к API выдается по заявке.

Компания также продемонстрировала адаптацию базовой модели для управления роботизированными манипуляторами, гуманоидными роботами и автомобилем, а также для обучения ИИ-агентов в сгенерированных средах. Эти возможности остаются экспериментальными и не входят в публичное демо.

В рейтинге Physics-IQ Verified Odyssey-3 Pro получила 66,10 балла при выборе лучшего результата из восьми вариантов. Однако этот показатель основан на одном запуске; средний результат стандартной серии из четырех запусков составил 63,37 балла.

Источник: odyssey.systems

Связь с редакцией