로봇은 다음 1초를 어떻게 예측하는가

텍스트 모델은 다음 단어를 맞힙니다. 세계 모델은 다음 프레임을 맞힙니다 — 질량과 속도와 중력까지 함께. 슬라이더 하나로 카메라에서 포구까지 한 바퀴를 따라갑니다.

단계 보이는 것
  1. 0
  2. 1
  3. 2
  4. 3
  5. 4

그림의 한 부분을 누르면 해당 단계가 열립니다.

한 바퀴 전체

프레임을 보고, 상태로 압축하고, 그 상태를 실시간보다 빠르게 굴리고, 롤아웃을 견딘 행동을 택하고, 벌어진 일과 상상한 일을 견줍니다. 그 차이가 다음 수업입니다.

구성

  1. 1 가장자리로 굴러가는 공 — 언어 모델이라면 설명을 붙였을 겁니다. 세계 모델은 다른 질문에 답합니다. 다음에 무슨 일이 일어나는가.
  2. 2 그림이 한 줌의 숫자가 된다 — 장면의 설명이 아니라, 앞으로 굴릴 수 있는 상태입니다.
  3. 3 움직이지 않고 쉰 걸음 앞으로 — 점들은 진짜 공이 아닙니다. 공보다 앞서 그려진 모델의 상상입니다.
  4. 4 제때 닿는 궤적을 팔이 고른다 — 여기서 계획이란 세계뿐 아니라 자기 선택지까지 함께 시뮬레이션하는 일입니다.
  5. 5 거의 겹치는 두 곡선 — 예측 오차가 세계 모델을 가르칩니다. 다음 단어의 오차가 언어 모델을 가르치듯이.

인터랙티브 설명

단계 보이는 것
  1. 0
  2. 1
  3. 2
  4. 3
  5. 4
1 / 5