CPN 한국어 자습서 · Claude Certified Developer — Foundations Prep
1-2 · LLM의 동작 방식
How LLMs behave: tokens, context, sampling, non-determinism
Claude API에서는 비용도, 입력이 들어가는 한도도, 응답의 길이도 전부 토큰이라는 단위로 계산합니다. 원문 레슨은 토큰 · 컨텍스트 윈도 · 샘플링 · 비결정성 네 주제를 탭으로 나눠 다루는데, 이 장에서는 그 출발점인 토큰부터 살펴봅니다. 모델이 실제로 무엇을 읽는지, 어떤 것들이 토큰으로 계산되는지 차례로 확인합니다.
이 장에서 배우는 것What you'll learn
Claude가 글자·단어가 아니라 토큰을 읽는다는 것
글자 수와 토큰 수의 환산이 모델(토크나이저)마다 다르다는 점
프롬프트부터 응답까지, 토큰으로 계산되는 다섯 항목
비용과 입력 크기를 어림할 때 토큰으로 세는 이유
Claude는 글자나 단어를 직접 읽지 않습니다. 텍스트를 토큰이라는 단위로 잘라 읽고, 응답을 만들 때도 같은 단위를 씁니다.
토큰 하나가 글자 몇 자에 해당하는지는 고정되어 있지 않습니다. 평균 환산치는 지금 쓰는 모델의 토크나이저에 따라 다르고, 모델 세대가 바뀌면 이 값도 함께 달라집니다. 그래서 "글자 몇 자당 토큰 하나" 같은 경험칙이 있더라도 모델에 따라 달라지는 참고값으로 보고, 실제 기능을 만드는 시점에는 현재 모델의 토크나이저가 어떻게 동작하는지 확인하는 것부터 시작합니다.
모델에게는 토큰이 곧 글자인 셈입니다. 우리가 원고 분량을 글자 수로 세듯, 모델과 주고받는 모든 분량은 토큰 수로 셉니다.
모델이 처리하는 것은 전부 토큰으로 계산됩니다. 이번에 보낸 요청만 세는 것이 아닙니다.
토큰은 과금의 단위이면서 예산의 단위이기도 합니다. 어떤 기능에 비용이 얼마나 들지 어림할 때도, 입력이 컨텍스트 윈도 안에 들어가는지 볼 때도, 실제로 세는 것은 단어가 아니라 토큰입니다. API가 청구하는 단위도, 컨텍스트 윈도를 재는 단위도 토큰이기 때문에, 처음부터 토큰 단위로 생각하는 습관을 들여 두면 좋습니다.
정답을 먼저 떠올려 본 뒤 골라 보세요. 맞히면 설명이 나옵니다.
Q1Claude가 텍스트를 읽는 단위는 무엇일까요?
Claude는 글자나 단어를 직접 읽지 않고 토큰 단위로 읽습니다. 응답을 만들 때도 같은 단위를 씁니다. 토큰 하나에 해당하는 글자 수는 모델의 토크나이저에 따라 달라집니다.
Q2다음 중 토큰으로 계산되지 않는 것은 무엇일까요?
프롬프트와 대화 기록만이 아니라 도구 정의, 도구 결과, 그리고 모델이 만들어 내는 응답까지 전부 토큰으로 계산됩니다. 과금과 컨텍스트 윈도 계산도 같은 단위로 이뤄집니다.
Q3"글자 몇 자당 토큰 하나" 식의 환산 경험칙은 어떻게 다루는 것이 좋을까요?
글자 수와 토큰 수의 환산 비율은 토크나이저가 정하는데, 이 비율이 모델 세대에 따라 바뀝니다. 그래서 경험칙은 참고로만 쓰고, 실제로 만들 때 현재 토크나이저의 동작을 확인하는 편이 안전합니다.
LLM의 동작 방식 이야기가 다음 레슨으로 이어집니다. → 다음 레슨 (1-3)