The Decoder

Odyssey-3 ist ein neuer generativer Weltmodell, den Sie kostenlos ausprobieren können

Odyssey stellt sein Weltmodell Odyssey-3 als öffentliche Forschungsvorstellung zur Verfügung. Das 14-Milliarden-Parametergroße Modell erstellt interaktive Umgebungen aus Textanweisungen in Echtzeit und kann laut…

Tomislav Bezmalinović
Bildquelle · The Decoder

Odyssey-3 ist ein neuer generativer Weltmodell, den Sie kostenlos ausprobieren können

Tomislav Bezmalinović Tomislav Bezmalinović 11. Oktober 2026 Image description Odyssey AI

Schlüsselpunkte

  • Die in Kalifornien ansässige KI-Firma Odyssey hat eine öffentliche Forschungsvorstellung ihres Weltmodells Odyssey-3 veröffentlicht.
  • Das Modell erstellt interaktive Umgebungen aus Textanweisungen in Echtzeit, sodass Benutzer sie aus verschiedenen Perspektiven erkunden und interagieren können.
  • Neben der Erzeugung virtueller Welten ist Odyssey-3 dafür konzipiert, als Grundlage für die Steuerung verschiedener Systeme zu dienen – von Robotarmen und Drohnen in simulierten Umgebungen bis hin zu Charakteren in Videospielen.

Odyssey stellt sein Weltmodell Odyssey-3 öffentlich zur Verfügung. Laut der Firma erzeugt es interaktive Welten in Echtzeit und erreicht bei physikalischen Tests die höchsten Ergebnisse.

Die in Kalifornien ansässige AI-Firma Odyssey hat eine öffentliche Forschungsvorstellung ihres Weltmodells Odyssey-3 veröffentlicht. Benutzer können interaktive Umgebungen aus Textanweisungen generieren und sie in Echtzeit erkunden. Das Modell simuliert physikalische Prozesse und vorhersagt, wie Umgebungen unter bestimmten Handlungen verändern sich. Entwickler können um Zugang zu einer API beantragt werden.

Gründer Oliver Cameron und Jeff Hawke zeigten das Modell erstmals am 15. September, mit Schwerpunkt auf Robotik, autonomer Fahrt und Videospielen. Was neu ist sind öffentlicher Zugang, mehr technische Details und Benchmarkergebnisse.

Interaktive AI-Welten, die Sie jetzt direkt ausprobieren können

Der kostenlose Online-Demo läuft auf Odyssey-3 Flash. Das Modell erstellt interaktive Umgebungen aus Textbeschreibungen. Die Benutzer können zwischen der Erzählperspektive Erstperson und Dritter wählen, durch die generierte Welt gehen, Ereignisse auslösen und beobachten, wie das Modell in Echtzeit reagiert.

Odyssey-3 basiert auf einem autoregressiven Diffusion-Tensor, der kontinuierlich neue Video-Frames basierend auf vorherigen Frames und Benutzerhandlungen erzeugt. Laut Odyssey lernt das Modell während des Trainings physikalische Beziehungen sowie Ursache-Wirkung aus visuellen Beobachtungen.

In den Trainingsdaten waren Internetvideos mit Ereignisbeschreibungen, Videogame-Szenen in Kombination mit den entsprechenden Tastatur- und Mausinputen sowie simulierte physische Interaktionen enthalten. Eine zusätzliche Trainingsmethode reduziert die Anzahl der erforderlichen Rechenschritte, wodurch die Echtzeitgenerierung möglich wird.

Das Basismodell von Odyssey-3 hat 14 Milliarden Parameter und erzeugt Videos mit 832 × 480 Pixeln, wie aus der offiziellen Benchmark-Einreichung hervorgeht. Das Odyssey-3 Pro unterstützt 1280 × 720 Pixeln.

Die Aussagen des physikalischen Benchmarks haben Einschränkungen

Laut der Firma erzielt das leistungsfähigere Odyssey-3 Pro 66,1 Punkte bei dem Video-zu-Video-Benchmark von Physics-IQ Verified. Der Test bewertet das physikalische Verhalten in Bereichen wie Flüssigkeitsmechanik, Optik, Festkörpermechanik, Magnetismus und Thermodynamik. Die Modelle müssen Videos von realen Experimenten fortsetzen, und ihre Ergebnisse werden mit den tatsächlichen Ergebnissen verglichen.

Dieser höchste Wert von 66,1 Punkten hat jedoch eine große Einschränkung. Er stammt aus einer einzigen Testrunde, bei der eine Auswahlmethode einen von acht generierten Videos für jede Aufgabe auswählte. Die Benchmark-Regeln erfordern vier Testrunden mit einem Standardabweichungswert für jede angebliche Bestleistung. Die gemeldete Bestleistung erfüllt diese Anforderung nicht. Ohne die Auswahlmethode lag der Durchschnitt von Odyssey-3 Pro bei 63,37 Punkten in vier Runden. Beide Ergebnisse sind auf der offiziellen Rangliste zu finden, wurden jedoch von Odyssey selbst eingereicht.

Screenshot durch Odyseey

Bei dem WorldMark-Benchmark erreicht Odyssey-3 in drei von vier Kategorien den ersten Platz basierend auf seiner eigenen Bewertung: Erstperson-Stylisiert (77,2), Dritte-Person-Wirklichkeit (79,0) und Dritte-Person-Stylisiert (76,3). In der Erstperson-Wirklichkeit belegt es den dritten Platz mit 80,6 Punkten. WorldMark testet, wie gut die Modelle die Steuerinstruktionen befolgen, wie gut die generierten Bilder aussehen und ob die simulierten Welten im Laufe der Zeit konsistent bleiben.

Eine Modellvorstellung für Roboter, Drohnen und GTA V

Odyssey möchte das gleiche Weltmodell für verschiedene Aufgaben verwenden – von der Bewegung von Roboterarmen bis hin zur Steuerung von Drohnen und Spielcharakteren. Für jede Anwendung wird das Modell mit einem spezialisierten Controller kombiniert, der seine Vorhersagen in konkrete Befehle umsetzt.

In den Tests konnte eine auf Odyssey-3 basierende KI mehrere Roboterarme steuern, wie das Unternehmen berichtet. Ein paar Dutzend Stunden an Demonstrationsdaten reichten aus für das Training. Die Roboter konnten auch selbst von fehlgeschlagenen Greifvorgängen wieder herunterkommen, obwohl diese Situationen nicht zum Trainingsdatensatz gehörten.

Für humanoide Roboter arbeitet Odyssey mit der Schweizer Robotikfirma Flexion. Die von Flexion auf Odyssey-3 entwickelten Steuerungen werden als zuverlässiger als Vergleichsmodelle angesehen, selbst wenn sich die Bedingungen ändern.

Odyssey baute außerdem einen Drohnensteuergerät auf, der mit simulierten Flugdaten trainiert wurde. In einer virtuellen Innenumgebung konnte die Drohne Hindernisse umgehen und nach Befehl zu bestimmten Zielen fliegen, wie das Unternehmen berichtet.

Odyssey-3 kann auch Videospiele spielen. Das Unternehmen zeigte eine KI, die autonom GTA V spielt, Fahrzeuge steuert und Gegner bekämpft. Ein Controller, der etwa zwei Stunden an GTA-Filmen trainiert wurde, konnte seine Fähigkeiten auch ohne zusätzliches Training auf Red Dead Redemption 2 übertragen – dabei einen Charakter zu Pferde bewegen.

Odyssey plant außerdem, sein Weltmodell zur Ausbildung von KI-Agenten zu verwenden. In einer Demonstration erhielt ein KI-Agent eine Aufgabe in natürlicher Sprache und versuchte, diese durch seine eigenen Handlungen in einer von Odyssey-3 generierten Umgebung zu erledigen. Ziel ist es, dass die Agenten aus den Ergebnissen ihrer eigenen Handlungen lernen können – ein potenziell neuer Trainingsparadigma für KI.

Die öffentliche Forschungsvorstellung bietet vorerst eine interaktive Umgebung, doch für Robotik und autonome Systeme sind weitere Arbeiten erforderlich.

Der Wettlauf um die Erstellung von Weltmodellen

Odyssey wurde 2023 von Oliver Cameron und Jeff Hawke gegründet. Im Juni 2026 sammelte das Unternehmen 310 Millionen Dollar von Investoren wie Amazon und AMD Ventures.

Die Weltmodell-Technologien zielen darauf ab, den KI-Systemen ein Verständnis für räumliche und physikalische Beziehungen zu geben. Google DeepMind verfolgt eine ähnliche Strategie mit Genie 3, um interaktive Welten zu generieren. World Labs, eine von Fei-Fei Li gegründete Startup, entwickelt ähnliche Technologien. AMD gab Ende September bekannt, dass es vor planen, World Labs für etwa 8,2 Milliarden US-Dollar zu erwerben.

AI-News ohne Hype – von Menschen zusammengestellt

Abonnieren Sie THE DECODER, um eine Werbefreie Lektüre, einen wöchentlichen AI-Newsletter, unseren exklusiven „AI Radar“ Frontier-Report sechsmal jährlich, Zugang zu dem vollständigen Archiv und Zugang zur Kommentarsektion zu erhalten.

Quelle: Odyssey
Originalquelle

The Decoder

Hinweise zum Inhalt

Originalveröffentlichung und Rechte liegen bei der Quelle.

Maschinelle Übersetzung · Original beachten