• 아틀라스는 텍스트·이미지·비디오·3D 데이터를 처리하도록 사전학습된 멀티모달 자가회귀 확산 트랜스포머 기반 모델이다.
  • 입력 이미지를 3D 공간 위치와 연결해 공유된 공간 컨텍스트를 만들고, 다음 장면이나 보이지 않는 공간을 물리적·공간적으로 일관되게 생성한다.
  • 단 한 장의 참조 이미지로 새로운 시점을 만들 수 있으며, 사용자 지정 카메라 위치·각도를 정밀하게 제어하고 최대 1440p 해상도의 1분 영상 생성이 가능하다.