두 시기
| 배우는 때 (학습) | 쓰는 때 (사용 · 추론) | |
|---|---|---|
| 언제 | 모델을 만들 때 한 번. 몇 주에서 몇 달 | 우리가 질문할 때마다. 몇 초 |
| 무엇을 | 엄청난 양의 글을 읽으며 안의 숫자를 조금씩 고친다 | 숫자는 그대로 두고, 들어온 글에 이어질 말을 계산한다 |
| 누가 | 만드는 회사가, 거대한 계산 설비로 | 우리가, 앱이나 사이트를 통해 |
| 비유 | 요리사가 수련하는 기간 | 주문을 받아 요리하는 순간 |
학습이 끝나면 모델은 굳은 상태로 배포된다. 수많은 사람이 같은 모델과 대화하지만, 그 대화가 모델 안의 숫자를 바꾸지는 않는다. 다음 판을 만들 때 다시 학습할 뿐이다.
대화로 가르쳐도 모델은 바뀌지 않는다
대화 도중 "그건 틀렸어, 이게 맞아"라고 하면 AI는 고쳐서 답한다. 배운 것처럼 보이지만, 사실은 방금 한 말이 대화 안에 남아 있어서 그것을 보고 잇는 것이다. 대화 안에 남는 분량을 컨텍스트라고 부른다 — 바로 다음 편에서 자세히 본다.
그래서 새 대화를 열면 처음으로 돌아간다. 지난 대화에서 고쳐 준 것은 없다. "지난번에 알려 줬잖아"가 통하지 않는 이유다.
그런데 '기억' 기능은?
요즘 앱에는 나를 기억하는 기능이 있다. 이것도 모델이 배운 것이 아니다. 앱이 나에 대한 메모를 따로 적어 두었다가, 새 대화를 열 때 첫머리에 슬쩍 붙여 넣는 것이다. 모델은 그 메모를 이번 대화의 일부로 읽을 뿐이다.
메모는 대개 설정에서 볼 수 있고, 지울 수 있다. 틀린 내용이 계속 따라다니면 모델을 탓할 것이 아니라 그 메모를 찾아 지우면 된다. 반대로, 적혀 있는 줄 모르는 사이에 개인적인 내용이 쌓일 수도 있다 — 어디서 확인하는지는 L0 · 10에서 본다.
학습 기준일 — 그 뒤의 일은 모른다
학습에 쓴 글은 어느 날까지 모은 것이다. 그날을 학습 기준일(knowledge cutoff)이라고 한다. 그 뒤에 나온 제품, 바뀐 가격, 새 법, 최근 사건은 모델 안에 없다. 없는 것을 물으면 — 앞 편에서 본 대로 — 그럴듯하게 지어낸다.
이 틈을 메우는 것이 웹 검색 기능이다. 모델이 검색 결과를 받아 읽고 답을 쓴다. 배운 것이 아니라 그 자리에서 읽은 것이다. 검색을 붙인 AI를 어떻게 믿고 쓰는지는 L1 · 06에서 다룬다.
같은 질문에 답이 매번 다른 까닭
다음 낱말을 고를 때, 모델은 가장 그럴듯한 하나만 고르지 않는다. 그럴듯한 후보 몇 개를 두고 확률에 따라 주사위를 굴리듯 하나를 뽑는다. 그래서 글이 기계처럼 딱딱하지 않고, 같은 질문에도 매번 조금씩 다르게 답한다.
| 이런 일에서는 | 답이 매번 다른 것이 |
|---|---|
| 글 초안, 제목 짓기, 아이디어 | 장점이다. 여러 번 받아 고르면 된다 |
| 사실 · 숫자 · 이름을 묻는 질문 | 신호다. 답이 흔들리면 모델이 그것을 모른다는 뜻이다 |
정리 — 세 줄
- 학습은 만들 때 한 번 끝났다. 대화는 쓰는 때이고, 대화가 모델을 바꾸지 않는다.
- '기억'은 앱이 적어 둔 메모를 대화 앞에 붙이는 것이다. 설정에서 보고 지울 수 있다.
- 학습 기준일 뒤의 일은 모른다. 답이 매번 다르면 그 사실은 모른다고 본다.
- 대화에서 "내가 좋아하는 색은 초록이야"라고 말한 뒤, 새 대화를 열어 "내가 좋아하는 색이 뭐야?"라고 묻는다.
- 쓰는 앱의 설정에서 기억(메모리) 기능을 찾아, 무엇이 적혀 있는지 열어 본다.
- "네 학습 기준일이 언제야?"라고 물은 뒤, 그 뒤에 일어난 일을 하나 물어본다. 검색 기능을 켰을 때와 껐을 때를 비교한다.
1번에서 기억하면 기억 기능이 켜져 있는 것이고, 못 하면 꺼져 있는 것이다. 어느 쪽이든 모델이 배운 것은 아니다.
대화 중에 틀린 것을 고쳐 주면, 다른 사람과의 대화에서도 고쳐져 있나?
아니다. 대화는 모델을 바꾸지 않는다. 그 대화 안에 남아 있어서 고쳐 답했을 뿐이다.
앱의 '기억' 기능은 어떻게 도는가?
앱이 메모를 따로 적어 두었다가 새 대화 첫머리에 붙여 넣는다. 모델이 배운 것이 아니라서 설정에서 보고 지울 수 있다.
같은 사실 질문에 답이 매번 다르면 무엇을 뜻하나?
모델이 그것을 모른다는 신호다. 자료를 주거나 검색을 붙이고, 원본으로 확인한다.
다음 편에서는 "대화 안에 남아 있다"는 말의 정체 — 토큰 · 컨텍스트 · 환각 — 을 본다.