토큰은 AI가 글을 읽고 답을 만들 때 쓰는 ‘글자 조각 단위’다. AI가 한 번에 다룰 수 있는 분량과 사용 요금이 모두 이 단위로 매겨진다. 다만 한 글자가 곧 한 토큰은 아니다. 그래서 글자 수만 세어서는 한도나 비용을 정확히 계산할 수 없다.
토큰은 글자 수와 뭐가 다를까
토큰은 글을 나눠 담는 작은 상자에 비유할 수 있다. 상자 하나에 한 글자가 들어갈 수도 있고, 단어의 일부나 단어 하나가 통째로 들어갈 수도 있다. 문장부호 하나도 토큰이 될 수 있다. 상자는 이해를 돕는 비유일 뿐이고, 핵심은 조각의 크기가 늘 같지는 않다는 점이다.
사람은 보통 글의 길이를 글자 수나 단어 수로 센다. AI는 입력과 출력을 토큰 단위로 처리한다. 그래서 같은 글이라도 사람이 센 글자 수와 AI가 처리한 토큰 수는 서로 다르다. ‘몇 글자를 썼는가’와 ‘몇 토큰을 썼는가’를 구분해야 하는 이유다.
이 차이는 긴 문서를 읽힐 때 특히 중요하다. 내가 보낸 문장의 길이만으로는 AI가 실제로 처리할 분량을 가늠하기 어렵기 때문이다. 내가 보낸 글뿐 아니라 AI가 만들어 낼 답까지 함께 생각해야 한다.
한국어는 몇 토큰일까
한국어 글자 수를 토큰 수로 바꾸는 공통 환산식은 없다. 토큰 수는 언어에 따라 달라지고, 어떤 모델을 쓰는지와 글을 어떻게 조각내는지에 따라서도 달라진다. 영어 글자 수로 토큰을 어림하는 안내를 봤더라도 한국어에 그대로 적용해서는 안 된다.
오픈AI, 앤트로픽, 구글의 공식 안내만으로는 한국어가 영어보다 항상 몇 배의 토큰을 쓴다고 단정할 수 없다. 특정 배수를 정해 놓고 한국어 문서의 길이를 계산하면 실제 사용량과 차이가 날 수 있다. 한국어 몇 글자가 몇 토큰인지 알고 싶다면 쓰려는 모델을 기준으로 확인해야 한다.
한국어 사용자에게 중요한 건 언어별 우열을 따지는 일이 아니다. 영어 기준의 대략적인 계산을 한국어 작업에 그대로 대입하지 않는 것이다. 글자 수가 같은 요청이라도 실제 토큰 수와 비용은 달라질 수 있다.
입력 한도에 답변도 들어갈까
모델이 한 번의 요청에서 다룰 수 있는 분량을 ‘컨텍스트 창’이라고 부른다. 쉽게 말해 한 번에 읽고 답하는 데 쓸 수 있는 전체 분량이다. 이 분량을 따질 때 새로 붙여 넣은 글만 생각해서는 부족하다.
이전 대화와 새 입력은 물론, AI가 내놓을 답변도 이 분량에 포함된다. 그러니 모델이 다룰 수 있다는 토큰 수를 전부 새 문서에 쓸 수 있는 양으로 이해하면 곤란하다. 긴 대화를 이어 가며 문서를 덧붙인다면 이전 대화, 새 문서, 답변을 함께 계산해야 한다.
이 분량은 모델마다 다르다. 어떤 모델의 한도를 확인했더라도 다른 모델에 그대로 적용할 수 없다. 토큰과 글자 수가 일치하지도 않으니 ‘AI에는 공통으로 몇 글자까지 넣을 수 있다’는 식의 설명도 정확하지 않다.
AI 요금표는 어떻게 읽을까
2026년 9월 기준으로 오픈AI, 앤트로픽, 구글은 요금을 입력 토큰과 출력 토큰으로 나눠 안내한다. 개발자가 자기 서비스에 AI를 붙여 쓸 때 적용되는 요금이다. 입력은 모델에 보내는 내용이고, 출력은 모델이 만들어 내는 답이다. 요금표를 볼 때 두 항목을 함께 봐야 하는 이유다.
긴 글을 보내 짧은 답을 받는 작업과, 짧은 요청으로 긴 답을 받는 작업을 떠올려 보자. 두 작업의 비용 구조는 서로 다르다. 보낸 내용과 받은 답의 토큰 수를 따로 세야 하는 이유다. 질문의 길이 하나만으로 전체 비용을 판단할 수는 없다.
실제 단가는 고른 모델과 캐시 사용 여부에 따라서도 달라진다. 캐시는 앞서 처리한 내용을 다시 활용해 비용을 아끼는 방식이다. 요금표에서 단가 하나만 떼어 보기보다 어떤 모델과 조건에 해당하는 값인지 확인하는 편이 정확하다. 금액을 비교할 때도 같은 조건인지 먼저 살펴야 한다.
실제로는 무엇부터 확인할까
순서는 세 단계로 잡으면 된다. 첫째, 쓰려는 모델을 정한다. 한 번에 다룰 수 있는 분량과 요금이 모델마다 다르기 때문이다. 회사 이름만 보고 계산을 시작하지 말고 모델별 안내를 읽는 것이 출발점이다.
둘째, 작업에 들어갈 내용을 나눠 본다. 한도를 볼 때는 이전 대화와 새 입력, 나올 답변을 함께 센다. 비용을 볼 때는 입력과 출력을 구분한다. 이렇게 나누면 ‘내가 쓴 글의 길이’만으로 한도와 비용을 한꺼번에 판단하는 실수를 줄일 수 있다.
셋째, 그 모델의 한도와 요금 조건을 확인한다. 한국어 글자 수에 영어용 환산 비율을 곱해 확정값처럼 쓰지 않는다. 토큰 수를 볼 때는 모델과 언어를, 단가를 볼 때는 입력과 출력, 캐시 조건을 함께 봐야 한다.
쓰기 전 네 가지만 기억하자
- 토큰 수는 글자 수나 단어 수와 같지 않다.
- 영어 기준의 어림값을 한국어에 그대로 적용하지 않는다.
- 한 번에 다룰 분량에는 이전 대화와 답변도 포함된다.
- 요금은 모델, 입력과 출력, 캐시 조건을 함께 확인한다.
토큰을 알면 긴 글을 다루는 한도와 AI 사용 요금을 더 정확히 읽을 수 있다. 모든 글을 일일이 조각내 세어 볼 필요는 없다. 글자 수와 토큰 수는 다르다는 사실만 기억하면 된다. 모델을 고르거나 요금표를 볼 때 그 모델이 다룰 수 있는 분량과 자신의 작업 조건을 함께 살피면 충분하다.
