Wie ein Sprachmodell lernt

Zieh an einem einzigen Regler und sieh zu, wie ein Haufen zufälliger Zahlen über tausend Schritte zu einer Vorhersage wird.

Trainingsschritte 0

Tippe auf einen Teil des Schemas, um den Schritt zu öffnen.

Der ganze Kreislauf

Textstücke → Zahlen → Schichten aus Gewichten → Punktzahlen → Prozente → Fehler → eine Korrektur an jedem Gewicht. Nichts wird auswendig gelernt: Training sind Millionen winziger Anpassungen an Zahlen, wiederholt, bis die richtige Fortsetzung die wahrscheinlichste ist.

Was drinsteckt

  1. 1 Der Text wird zerschnitten — Das führende Leerzeichen gehört zum Stück, deshalb sind « trinkt» und «trinkt» zwei verschiedene Zeilen.
  2. 2 Zahlen statt Wörter — Beweg den Regler, und das Zittern hört auf — die Zahlen setzen sich auf sinnvolle Werte.
  3. 3 Schichten und Attention — Die Linienfarbe ist das Vorzeichen des Gewichts, die Dicke seine Größe. Im Moment ist jedes Gewicht zufällig.
  4. 4 Die Vorhersage — Die richtige Fortsetzung, «Milch», steht noch auf Platz drei.
  5. 5 Fehler und Lernen — Der Regler treibt diesen Kreislauf: Bei Schritt 1000 steht «Milch» bei 92%, «Traktor» bei 0.01%, und der Fehler ist auf 0.08 gefallen.
Weiterlesen Wie ich versehentlich ein LLM-Orchestrierungssystem im Browser gebaut habe Ein architektonischer Blick darauf, wie Litseller die GPT-API, React, Prompts und Orchestrierung im Browser nutzte, um strukturierte Inhalte für einen Buchkatalog zu erzeugen.

Interaktive Erklärungen

Trainingsschritte 0
1 / 5