언어 모델은 어떻게 글을 쓰는가

가중치는 얼어 있고 아무것도 기억되지 않습니다. 슬라이더를 당겨, 모델이 다음 조각을 거듭 고르는 과정을 보세요.

온도 1.00
Top-P 0.90

그림의 한 부분을 누르면 해당 단계가 열립니다.

반복 전체

문자열 → 조각 → 앞선 조각들과의 연결 → 고정된 층 → 확률 → 꼬리를 자르고 무작위로 하나 뽑기 → 조각을 끝에 붙이기. 그리고 다시 처음부터. 모델을 쓰는 동안 이 밖의 일은 일어나지 않습니다.

구성

  1. 1 문맥과 조각 — 창은 유한합니다. 다 차면 생성이 멈춥니다. 창 밖의 것을 모델은 아무것도 가지고 있지 않습니다.
  2. 2 문맥에 대한 어텐션 — 선은 매 단계마다 처음부터 다시 계산됩니다. 조각 하나가 늘면 그림 전체가 달라집니다.
  3. 3 고정된 가중치 — 학습은 가중치를 바꾸고, 사용은 바꾸지 않습니다. 같은 신경망의 서로 다른 두 모드입니다.
  4. 4 확률, 온도, Top-P — 두 슬라이더를 움직여 「바나나」를 보세요. 높은 온도와 1에 가까운 Top-P의 대가가 거기 있습니다.
  5. 5 생성의 반복 — 모델은 문장을 쓰는 것이 아닙니다. 한 걸음 나아가고 또 한 걸음 나아갈 뿐입니다.
더 읽기 AI 의존에 대하여: 형인 줄 알았던 상대는 동생이었다 AI와의 솔직한 대화가 어떻게 기업에게 선물이 되었는지, 그리고 루틴은 모델에 맡기고 사고는 왜 사람에게 남겨야 하는지에 대하여.

인터랙티브 설명

온도 1.00
Top-P 0.90
1 / 5