오딧세이는 8일(현지시간) 파운데이션 월드 모델 '오딧세이-3'의 연구 프리뷰를 공개했다. 이 모델은 영상과 관측 데이터를 바탕으로 현실 세계의 물리 특성, 사물의 움직임, 인과관계를 학습해 다음 상태를 예측한다. 텍스트나 이미지 생성보다 환경 변화와 행동의 결과를 모델링하는 데 초점을 둔 점이 특징이다. 체험용 플레이그라운드에서는 경량 버전인 '오딧세이-3 플래시' 기반 실시간 모델을 무료로 시험할 수 있다.

학습에는 인터넷 영상, 시간대별 사건 주석 데이터, 키보드·마우스 입력이 포함된 게임 영상, 물리 시뮬레이션으로 만든 강체 상호작용 데이터가 쓰였다. 'GTA V'와 '레드 데드 리뎀션 2'의 플레이 영상과 입력 데이터도 활용됐다. 모델은 비디오 디퓨전 트랜스포머와 자기회귀 학습, 지식 증류를 조합해 실시간 상호작용이 가능하도록 설계됐다. 고성능 버전은 Physics-IQ Verified의 비디오 투 비디오에서 66.1점, 이미지 투 비디오에서 54.7점을 기록했고, WorldMark 4개 범주 중 3개에서 1위를 차지했다. 다만 이런 벤치마크 성과가 실제 로봇이나 자율주행의 모든 작업 성능을 보장하는 것은 아니라고 밝혔다.