Wie ein Roboter die nächste Sekunde vorhersagt

Ein Textmodell rät das nächste Wort. Ein Weltmodell rät das nächste Bild — samt Masse, Geschwindigkeit und Schwerkraft. Ein Regler führt durch den ganzen Kreis, von der Kamera bis zum Fang.

Stufe Was er sieht
  1. 0
  2. 1
  3. 2
  4. 3
  5. 4

Tippen Sie auf einen Teil der Grafik, um die Stufe zu öffnen.

Der Kreis von Anfang bis Ende

Ein Bild sehen, es zu einem Zustand verdichten, diesen Zustand schneller als in Echtzeit laufen lassen, die Handlung nehmen, die die Vorausrechnung übersteht, und dann das Geschehene mit dem Vorgestellten vergleichen. Die Differenz ist die Lehre.

Was drinsteckt

  1. 1 Ein Ball rollt auf die Kante zu — Ein Sprachmodell würde eine Bildunterschrift schreiben. Ein Weltmodell beantwortet eine andere Frage: Was passiert als Nächstes?
  2. 2 Das Bild wird zu einer Handvoll Zahlen — Keine Beschreibung der Szene, sondern ein Zustand, den man vorwärts laufen lassen kann.
  3. 3 Fünfzig Schritte voraus, ohne sich zu bewegen — Die Punkte sind nicht der echte Ball, sondern die Vorstellung des Modells, ihm vorausgezeichnet.
  4. 4 Der Arm nimmt die Bahn, die rechtzeitig ankommt — Planen heißt hier, die eigenen Möglichkeiten zu simulieren, nicht nur die Welt.
  5. 5 Zwei Kurven, die fast zusammenfallen — Der Vorhersagefehler lehrt ein Weltmodell so, wie der Fehler beim nächsten Wort ein Textmodell lehrt.

Interaktive Erklärungen

Stufe Was er sieht
  1. 0
  2. 1
  3. 2
  4. 3
  5. 4
1 / 5