Odyssey-3는 무료로 체험할 수 있는 새로운 생성형 월드 모델입니다
토미슬라브 베즈말리노비치
2026년 10월 11일
Odyssey AI
주요 내용
- 캘리포니아에 기반을 둔 AI 기업 Odyssey가 자사의 월드 모델 Odyssey-3의 공개 리서치 프리뷰를 출시했습니다.
- 이 모델은 텍스트 프롬프트로부터 실시간으로 인터랙티브 환경을 생성하여, 사용자가 다양한 시점에서 이를 탐색하고 상호작용할 수 있게 해준다.
- 가상 세계를 생성하는 것을 넘어, Odyssey-3는 시뮬레이션 환경의 로봇 팔과 드론부터 비디오 게임 속 캐릭터까지 다양한 시스템을 제어하기 위한 기반으로 활용되도록 설계되었습니다.
Odyssey가 자사의 월드 모델인 Odyssey-3를 대중에게 공개했습니다. 회사에 따르면 이 모델은 실시간으로 인터랙티브한 세계를 생성하며 물리 벤치마크에서 최고 점수를 달성합니다.
캘리포니아에 기반을 둔 AI 회사 Odyssey가 자사의 공개 연구 프리뷰를 출시했습니다. 월드 모델 Odyssey-3. 사용자는 텍스트 프롬프트로 대화형 환경을 생성하고 실시간으로 탐색할 수 있습니다. 이 모델은 물리적 과정을 시뮬레이션하고 특정 행동에 따라 환경이 어떻게 변화하는지 예측합니다. 개발자는 API 액세스를 신청할 수 있습니다.
공동창업자 Oliver Cameron과 Jeff Hawke 해당 모델을 처음 공개했습니다. 9월 15일에 열리며, 로봇공학, 자율주행, 비디오 게임에 중점을 둔다. 지금 새로운 소식 공개 접근성, 더 많은 기술적 세부 사항, 그리고 벤치마크 결과입니다.
지금 바로 체험할 수 있는 인터랙티브 AI 세계
The 무료 온라인 데모 Odyssey-3 Flash에서 구동됩니다. 이 모델은 텍스트 설명으로부터 대화형 환경을 생성합니다. 사용자는 1인칭 시점과 3인칭 시점 중 선택하고, 생성된 세계를 이동하고, 이벤트를 발생시키고, 모델이 실시간으로 반응하는 것을 볼 수 있습니다.
Odyssey-3는 이전 프레임과 사용자 행동을 기반으로 새로운 비디오 프레임을 지속적으로 생성하는 자기회귀적 확산 트랜스포머(autoregressive diffusion transformer)를 기반으로 구축되었습니다. Odyssey에 따르면, 이 모델은 훈련 과정에서 시각적 관찰을 통해 물리적 관계와 인과 관계를 학습합니다.
학습 데이터에는 이벤트 설명이 포함된 인터넷 영상, 키보드와 마우스 입력이 짝지어진 비디오 게임 영상, 그리고 모의 물리적 상호작용이 포함되었습니다. 추가 학습 기법은 필요한 연산 단계 수를 줄여 실시간 생성을 가능하게 합니다.
기본 Odyssey-3 모델은 140억 개의 파라미터를 보유하고 있으며 832 × 480 픽셀 해상도로 비디오를 생성합니다. 다음 자료에 따르면 공식 벤치마크 제출. Odyssey-3 Pro는 1280 × 720 픽셀을 지원합니다.
물리학 벤치마크 주장에는 단서가 붙는다
더 강력한 Odyssey-3 Pro는 다음에서 제공하는 비디오-투-비디오 벤치마크에서 66.1점을 기록했습니다 Physics-IQ 검증됨회사에 따르면. 이 테스트는 유체역학, 광학, 고체역학, 자기, 열역학 등 여러 분야에서 물리적 거동을 평가합니다. 모델은 실제 실험 영상을 이어서 생성해야 하며, 그 출력 결과는 실제 결과와 비교됩니다.Ad
다만 66.1점이라는 최고 점수에는 중대한 단서가 붙습니다. 이 점수는 선택 방식이 각 작업마다 생성된 8개의 영상 중 하나를 골라낸 단일 테스트 실행에서 나온 것입니다. 벤치마크 규칙은 기록 주장에 대해 표준 편차를 보고하면서 4회의 테스트 실행을 요구합니다. 보고된 기록은 그 기준을 충족하지 못합니다. 선택 방식 없이는 Odyssey-3 Pro가 4회 실행에서 평균 63.37점을 기록했습니다. 두 결과 모두 다음에 나와 있습니다 공식 리더보드 하지만 Odyssey가 직접 제출한 것이었습니다.

온 더 WorldMark 벤치마크, Odyssey-3는 4개 부문 중 3개 부문에서 다음과 같은 기준으로 1위를 차지한다. 직접 평가: 1인칭 스타일화(77.2), 3인칭 실사(79.0), 3인칭 스타일화(76.3)입니다. 1인칭 실사에서는 80.6점으로 3위를 기록했습니다. WorldMark는 모델이 제어 지시를 얼마나 잘 따르는지, 생성된 이미지가 얼마나 좋아 보이는지, 그리고 시뮬레이션된 세계가 시간이 지나도 일관성을 유지하는지를 테스트합니다.
로봇, 드론, 그리고 GTA V를 위한 하나의 모델
Odyssey는 로봇 팔 조작부터 드론 항법, 게임 캐릭터 제어에 이르는 다양한 작업에서 동일한 월드 모델을 사용하고자 합니다. 각 응용 분야마다 모델은 예측을 구체적인 명령으로 변환하는 전문 컨트롤러와 결합됩니다.
회사에 따르면, 테스트에서 Odyssey-3를 기반으로 구축된 AI가 여러 로봇 팔을 제어했습니다. 단 몇십 시간의 시연 데이터만으로도 훈련에 충분했습니다. 로봇들은 훈련 데이터에 포함되지 않은 상황임에도 불구하고 실패한 파지에서 스스로 복구할 수 있었습니다.
휴머노이드 로봇 분야에서 Odyssey는 스위스 로보틱스 회사와 협력하고 있습니다 FlexionFlexion이 Odyssey-3 기반으로 제작한 컨트롤러는 조건이 변하더라도 비교 모델보다 더 안정적으로 작동하는 것으로 알려졌다.
Odyssey는 시뮬레이션 비행 데이터로 학습된 드론 컨트롤러도 개발했습니다. 회사에 따르면 가상 실내 환경에서 드론은 장애물을 피하고 명령에 따라 특정 목표물까지 비행할 수 있었다고 합니다.
Odyssey-3는 비디오 게임도 할 수 있습니다. 이 회사는 AI가 GTA V를 자율적으로 플레이하며 차량을 조종하고 적과 싸우는 모습을 시연했습니다. 약 2시간 분량의 GTA 영상으로 학습된 컨트롤러는 추가 학습 없이도 Red Dead Redemption 2로 기술을 전이해 말을 탄 캐릭터를 움직일 수 있었습니다.
Odyssey는 또한 자사의 월드 모델을 AI 에이전트 훈련에 활용할 계획이다. 한 데모에서 AI 에이전트는 자연어로 된 작업을 받고 Odyssey-3가 생성한 환경 안에서 자신의 행동을 통해 이를 완료하려고 시도했다. 목표는 에이전트가 자신의 행동 결과로부터 학습하도록 하는 것이다, AI를 위한 잠재적으로 새로운 훈련 패러다임.
퍼블릭 리서치 프리뷰는 현재 인터랙티브 환경 생성 기능을 제공하며, 로봇공학과 자율 시스템에는 추가 작업이 필요합니다.
월드 모델 구축 경쟁
Odyssey는 2023년 Oliver Cameron과 Jeff Hawke가 설립했습니다. 2026년 6월, 이 회사는 310백만 달러를 조달했습니다 Amazon과 AMD Ventures를 포함한 투자자들로부터.
월드 모델은 AI 시스템에 공간적·물리적 관계에 대한 이해를 부여하는 것을 목표로 합니다. Google DeepMind는 유사한 접근 방식으로 Genie 3 를 통해 상호작용 가능한 세계를 생성하고 있습니다. World Labs, 즉 Fei-Fei Li가 설립한 스타트업도 유사한 기술을 개발하고 있습니다. AMD는 9월 말에 약 82억 달러 규모로 World Labs를 인수할 계획이라고 발표했습니다.
AI News Without the Hype – Curated by Humans
광고 없는 읽기 환경, 주간 AI 뉴스레터, 연 6회 제공되는 독점 "AI Radar" 프론티어 리포트, 전체 아카이브 접근, 그리고 댓글 섹션 이용을 위해 THE DECODER를 구독하세요.
출처: Odyssey