언어 모델은 어떻게 배우는가

슬라이더 하나를 당겨서, 무작위 숫자 더미가 천 번의 단계를 거쳐 예측으로 변해가는 과정을 보세요.

학습 단계 0

그림의 한 부분을 누르면 해당 단계가 열립니다.

순환 전체

문장 조각 → 숫자 → 가중치의 층 → 점수 → 비율 → 오차 → 모든 가중치의 미세 수정. 통째로 외우는 일은 없습니다. 학습이란 올바른 다음 말이 가장 그럴듯해질 때까지 숫자를 수백만 번 조금씩 고치는 일입니다.

구성

  1. 1 문장을 조각으로 자른다 — 앞의 공백과 조사도 조각의 일부라, 자르는 위치가 다르면 다른 줄이 됩니다.
  2. 2 단어 대신 숫자 — 슬라이더를 움직이면 떨림이 멎고, 숫자는 의미 있는 값에 내려앉습니다.
  3. 3 층과 어텐션 — 선의 색은 가중치의 부호, 굵기는 크기입니다. 지금은 모든 가중치가 무작위입니다.
  4. 4 예측 — 올바른 다음 말인 「우유」는 아직 3등입니다.
  5. 5 오차와 학습 — 슬라이더가 이 순환을 돌립니다. 1000단계에서 「우유」는 92%, 「트랙터」는 0.01%, 오차는 0.08까지 떨어집니다.
더 읽기 나도 모르게 브라우저에서 LLM 오케스트레이션 시스템을 만든 이야기 Litseller가 GPT API와 React, 프롬프트, 브라우저 쪽 오케스트레이션으로 책 카탈로그의 구조화된 콘텐츠를 만들어 낸 방식을 아키텍처의 눈으로 돌아봅니다.

인터랙티브 설명

학습 단계 0
1 / 5