Comment un robot prédit la seconde suivante

Un modèle de texte devine le mot suivant. Un modèle du monde devine l’image suivante — masse, vitesse et gravité comprises. Un seul curseur parcourt la boucle entière, de la caméra à la prise.

Étape Ce qu’il voit
  1. 0
  2. 1
  3. 2
  4. 3
  5. 4

Touchez une partie du schéma pour ouvrir cette étape.

La boucle en entier

Voir une image, la comprimer en un état, faire avancer cet état plus vite que le temps réel, prendre l’action qui survit au déroulé, puis comparer ce qui est arrivé à ce qui avait été imaginé. La différence est la leçon.

Ce qu’il y a dedans

  1. 1 Une balle roule vers le bord — Un modèle de langue en écrirait la légende. Un modèle du monde répond à une autre question : que se passe-t-il ensuite ?
  2. 2 L’image devient une poignée de nombres — Ce n’est pas une description de la scène, mais un état que l’on peut faire avancer.
  3. 3 Cinquante pas en avant, sans bouger — Les points ne sont pas la vraie balle : c’est l’imagination du modèle, dessinée devant elle.
  4. 4 Le bras prend la trajectoire qui arrive à temps — Planifier, ici, c’est simuler ses propres options, pas seulement le monde.
  5. 5 Deux courbes qui coïncident presque — L’erreur de prédiction instruit un modèle du monde comme l’erreur sur le mot suivant instruit un modèle de texte.

Explications interactives

Étape Ce qu’il voit
  1. 0
  2. 1
  3. 2
  4. 3
  5. 4
1 / 5