byteforce

CPN 한국어 자습서 · Claude Certified Developer — Foundations Prep

1-2 · LLM의 동작 방식

토큰 — 입력·출력·비용의 단위

How LLMs behave: tokens, context, sampling, non-determinism

Claude API에서는 비용도, 입력이 들어가는 한도도, 응답의 길이도 전부 토큰이라는 단위로 계산합니다. 원문 레슨은 토큰 · 컨텍스트 윈도 · 샘플링 · 비결정성 네 주제를 탭으로 나눠 다루는데, 이 장에서는 그 출발점인 토큰부터 살펴봅니다. 모델이 실제로 무엇을 읽는지, 어떤 것들이 토큰으로 계산되는지 차례로 확인합니다.

이 장에서 배우는 것What you'll learn

1

Claude가 글자·단어가 아니라 토큰을 읽는다는 것

2

글자 수와 토큰 수의 환산이 모델(토크나이저)마다 다르다는 점

3

프롬프트부터 응답까지, 토큰으로 계산되는 다섯 항목

4

비용과 입력 크기를 어림할 때 토큰으로 세는 이유

먼저 짚고 갈 용어
토큰 (token)
모델이 텍스트를 읽고 쓰는 단위. 글자·단어와 1:1로 맞아떨어지지 않으며, 모델이 처리하는 모든 텍스트가 이 단위로 계산된다.
토크나이저 (tokenizer)
텍스트를 토큰으로 자르는 규칙. 모델 세대마다 달라서, 같은 문장이라도 모델에 따라 토큰 수가 다를 수 있다.
컨텍스트 윈도 (context window)
모델이 한 번에 다룰 수 있는 범위. 이 크기도 토큰 단위로 잰다.

모델이 읽는 단위, 토큰

Tokens: the unit of input, output, and cost

Claude는 글자나 단어를 직접 읽지 않습니다. 텍스트를 토큰이라는 단위로 잘라 읽고, 응답을 만들 때도 같은 단위를 씁니다.

토큰 하나가 글자 몇 자에 해당하는지는 고정되어 있지 않습니다. 평균 환산치는 지금 쓰는 모델의 토크나이저에 따라 다르고, 모델 세대가 바뀌면 이 값도 함께 달라집니다. 그래서 "글자 몇 자당 토큰 하나" 같은 경험칙이 있더라도 모델에 따라 달라지는 참고값으로 보고, 실제 기능을 만드는 시점에는 현재 모델의 토크나이저가 어떻게 동작하는지 확인하는 것부터 시작합니다.

쉽게 말하면

모델에게는 토큰이 곧 글자인 셈입니다. 우리가 원고 분량을 글자 수로 세듯, 모델과 주고받는 모든 분량은 토큰 수로 셉니다.

토큰으로 계산되는 것들

Everything is counted in tokens

모델이 처리하는 것은 전부 토큰으로 계산됩니다. 이번에 보낸 요청만 세는 것이 아닙니다.

토큰은 과금의 단위이면서 예산의 단위이기도 합니다. 어떤 기능에 비용이 얼마나 들지 어림할 때도, 입력이 컨텍스트 윈도 안에 들어가는지 볼 때도, 실제로 세는 것은 단어가 아니라 토큰입니다. API가 청구하는 단위도, 컨텍스트 윈도를 재는 단위도 토큰이기 때문에, 처음부터 토큰 단위로 생각하는 습관을 들여 두면 좋습니다.

기억할 점

스스로 점검

Self-check

정답을 먼저 떠올려 본 뒤 골라 보세요. 맞히면 설명이 나옵니다.

Q1Claude가 텍스트를 읽는 단위는 무엇일까요?

Q2다음 중 토큰으로 계산되지 않는 것은 무엇일까요?

Q3"글자 몇 자당 토큰 하나" 식의 환산 경험칙은 어떻게 다루는 것이 좋을까요?