토큰 계산기

OpenAI o200k_base·cl100k_base와 DeepSeek 공식 토크나이저로 토큰 수를 브라우저에서 정확히 계산합니다. 토큰 분할을 보여 주고 GPT·Claude·Gemini·DeepSeek 비용도 계산합니다.

  • 브라우저에서 처리
  • 데이터가 브라우저 밖으로 나가지 않습니다
  • 무료 · 회원가입 불필요
일반 텍스트, 프롬프트, 코드를 붙여 넣으면 입력에 맞춰 갱신합니다. 수정하거나 지우면 이전 계산을 종료합니다. 역할 표시, 도구 정의, 이미지, PDF는 포함하지 않습니다.
20 MB 이하 UTF-8 텍스트 파일을 열어 입력을 바꿉니다. 계속 입력하거나 「예시」 또는 「지우기」를 누르면 진행 중이던 파일 읽기는 무효가 됩니다.
예상 출력 토큰 수를 입력하면 요청당 출력 비용과 합계를 추산합니다. 답변을 생성하지 않습니다. 표준 가격에는 배치 및 캐시 할인이 없습니다.
토크나이저를 고르면 처음 2,000개 토큰을 표시하며, 아직 없으면 어휘도 불러옵니다. 토큰 ID 표시를 켜면 상자에 숫자 ID를 붙입니다. 전체 개수에는 모든 토큰을 셉니다.

텍스트를 입력하거나 붙여넣으면 입력에 맞춰 수가 바뀝니다.

토크나이저 어휘는 필요할 때 이 사이트에서 불러옵니다. 입력 텍스트는 브라우저 안에 남습니다.

— 토큰 (o200k_base) o200k_base는 자동으로 셉니다. DeepSeek V4나 cl100k_base 카드의 「계산」은 해당 어휘(0.5 MB, 0.4 MB)를 불러오고, 실패하면 「다시 시도」가 나옵니다. 각 개수는 공개된 토크나이저 규칙을 따릅니다. 0 문자 0 UTF-8 바이트 0 단어 0 줄

o200k_base

정확

— 토큰

GPT-5.5, GPT-5.4, GPT-4.1, GPT-4o, o3, o4-mini

DeepSeek V4

정확

— 토큰

deepseek-flash, deepseek-v4-pro

cl100k_base

정확

— 토큰

GPT-4, GPT-3.5 Turbo, text-embedding-3

Claude · Gemini · GPT-6

로컬 토크나이저 없음

로컬에서 실행할 수 있는 토크나이저가 공개되지 않았습니다. 정확한 수는 각 회사의 무료 토큰 계산 API로 확인하세요. 아래 표는 이 모델들에 o200k_base 수를 참고값으로 씁니다.

모델별 비용

모델 입력 토큰 컨텍스트 사용률 입력 출력 합계

≈ 는 o200k_base 수를 참고값으로 쓴 결과입니다. 이 모델들은 각자의 토크나이저를 쓰므로 실제 수는 다릅니다. Anthropic에 따르면 Claude 4.7 이후 모델은 같은 텍스트에서 이전 Claude보다 토큰이 약 30% 많습니다.

토큰 분할

상자 하나가 토큰 하나입니다. ⟨⟩ 안은 한 글자의 일부 바이트이며, 다음 토큰이 나머지를 가집니다.

자세한 가이드 읽기 AI 토큰이란: 토크나이저가 한국어를 세는 방식
예시·자세한 설명·자주 묻는 질문 실제 출력이 있는 예시, 다른 도구와의 차이, 자주 묻는 질문.

한국어 토큰 수 비교

회의록 요약을 부탁하는 같은 뜻의 지시문을 영어와 한국어로 세어 보았습니다.

텍스트문자 수o200k_basecl100k_baseDeepSeek V4
Summarize the meeting notes below in three lines and list the decisions and action items.89181817
아래 회의록을 세 줄로 요약하고 결정 사항과 할 일을 목록으로 정리해 주세요.43243528

영어는 세 토크나이저가 거의 같지만, 한국어는 cl100k_base가 o200k_base보다 46% 많습니다. 한글 음절은 UTF-8로 3바이트라서, 어휘에 없는 음절은 여러 바이트 토큰으로 나뉩니다. 토큰 분할에서 ⟨⟩ 안에 16진수로 보이는 칸이 그런 경우입니다.

짧은 인사말 「안녕하세요, 세계」는 o200k_base 4, DeepSeek V4 7, cl100k_base 10 토큰입니다. 중국어에서는 DeepSeek이 가장 적은 경우가 많지만 한국어에서는 o200k_base보다 많아지는 일이 흔합니다.

「예시」 버튼이 넣는 277자의 리뷰 요청문 결과입니다.

토크나이저토큰 수토큰당 문자 수
o200k_base1641.69
DeepSeek V41761.57
cl100k_base2311.20

정확히 셀 수 있는 모델

  • o200k_base: GPT-5.x, GPT-4.1, GPT-4o, o1, o3, o4-mini. 근거는 OpenAI tiktoken의 모델 대응표입니다.
  • cl100k_base: GPT-4, GPT-3.5 Turbo, 그리고 임베딩 가이드가 지정한 text-embedding-3. 임베딩 입력 한도 8,192 토큰을 확인할 때 씁니다.
  • DeepSeek V4: deepseek-flash, deepseek-v4-pro. DeepSeek 오프라인 계산 패키지의 tokenizer.json으로 만들었습니다.
  • Claude, Gemini, GPT-6: 로컬 토크나이저가 공개되지 않았습니다. Anthropic의 토큰 계산 API는 무료지만 문서 스스로 결과를 추정값이라고 하며, Claude 4.7 이후 모델은 같은 텍스트에서 이전 Claude보다 토큰이 약 30% 많다고 밝힙니다. Google 문서는 「토큰 하나는 약 4자」라는 기준만 줍니다. 표에서는 이 모델들에 o200k_base 수를 참고값으로 쓰고 ≈를 붙입니다.

비용 표 읽는 법

단가는 2026년 10월 1일 확인한 표준 가격(배치 할인·캐시 미적용)이며 모두 미국 달러입니다. 긴 입력에서 단가가 오르는 모델은 자동으로 바꿔 계산합니다. gpt-5.5와 GPT-6는 입력 272,000 토큰 초과, gemini-3.1-pro-preview는 200,000 토큰 초과입니다. DeepSeek은 혼잡 시간(한국 시간 평일 10~13시, 15~19시) 외에는 절반 가격이라 두 금액을 함께 보여 줍니다.

다른 도구와의 차이

2026년 10월 1일 확인한 내용입니다.

  • tokencounter.org 한국어판: 모델 목록이 GPT-4 Turbo, GPT-4, GPT-3.5, Davinci, Babbage뿐이라 GPT-4o 이후의 o200k_base로는 셀 수 없습니다.
  • tokencalculator.app 한국어판: 모델 목록에 「Claude Sonnet 4.7」「Claude Haiku 4.6」이 있지만, Anthropic 가격 페이지에는 그런 모델이 없습니다.
  • tokencost.app: 중국어 문장 하나(실제 DeepSeek V4 26 토큰)에서 DeepSeek V4.1 Flash를 「42~」로 표시했습니다.

이 페이지의 이전 버전은 js-tiktoken을 썼습니다. js-tiktoken은 공백 없이 긴 문자열에서 병합이 매우 느려 한자 2만 자가 이어진 입력에 3분 넘게 걸렸습니다. 새 버전은 우선순위 큐로 병합해 같은 입력을 몇 밀리초에 처리하고, BOM(U+FEFF)이 들어간 텍스트도 tiktoken과 같은 위치에서 자릅니다.

제한 사항

문자 통계, 사전 분할, 토큰 계산은 Web Worker에서 실행합니다. 입력을 수정하거나 지우면 이전 계산을 종료합니다. 페이지에는 통계, 전체 개수, 처음 2,000개 토큰의 표시 데이터만 반환합니다. 큰 텍스트를 입력란에 표시하는 데는 여전히 시간이 걸릴 수 있습니다. 저희 테스트(Apple M1 Max, Chromium 152, 2026-10-03)에서 중국어와 영어가 섞인 100만 자를 입력란에 표시하는 데 12초, 이어서 o200k_base로 세는 데 약 1.11.9초가 걸렸습니다.

  • 일반 텍스트만 셉니다. 메시지 형식, 시스템 프롬프트, 도구 정의, 이미지, PDF가 더하는 토큰은 각 회사 API만 알 수 있습니다.
  • <|endoftext|> 같은 OpenAI 특수 토큰은 일반 문자열로 셉니다(7 토큰). tiktoken의 encode_ordinary와 같습니다. DeepSeek의 <|User|> 같은 표시는 공식 tokenizer.json대로 1 토큰입니다.
  • Claude, Gemini, GPT-6 행은 참고값입니다.
  • DeepSeek 패키지의 예제는 transformers로 불러옵니다. transformers 5.18.0에서는 이 패키지로 중국어 텍스트를 넣으면 빈 목록이 나왔고, 4.57.6과 tokenizers 라이브러리는 이 페이지와 같은 결과를 냈습니다.
  • 가격은 2026년 10월 1일 기준이며 세금, 지역별 할증, 개별 계약 할인은 넣지 않았습니다.

관련 도구: 글자 수와 단어 수는 단어 및 문자 카운터, 프롬프트에 남은 API 키는 API 키 마스킹 도구, 배치 요청 파일은 JSONL 변환기에서 다룹니다.

FAQ

어떤 숫자가 정확한가요?

o200k_base, cl100k_base, DeepSeek V4 세 카드입니다. OpenAI tiktoken, DeepSeek 공식 tokenizer.json과 같은 어휘와 병합 규칙을 쓰며, 테스트에서 1,500개가 넘는 문자열의 토큰 ID를 참조 구현과 비교합니다. Claude, Gemini, GPT-6는 로컬에서 실행할 수 있는 토크나이저가 공개되지 않아 표에서 o200k_base 수를 참고값으로 ≈ 표시와 함께 보여 줍니다.

API 응답의 usage와 왜 다른가요?

이 도구는 텍스트 한 덩어리만 셉니다. 실제 요청에는 역할 표시와 구분자, 시스템 프롬프트, 도구 정의, 이미지와 파일이 더해집니다. OpenAI는 토큰 계산 API 결과에 이런 형식 토큰이 들어가며 로컬 토크나이저로는 보이지 않는다고 설명합니다. 비교할 부분만 붙여넣거나, 각 회사 API에 요청 전체를 넣어 확인하세요.

입력한 텍스트가 전송되나요?

전송되지 않습니다. 계산은 브라우저 안의 Web Worker에서 합니다. 토크나이저 어휘는 이 사이트의 정적 파일을 필요할 때 불러옵니다. 이전 작업을 종료한 뒤 다음 계산에서 어휘를 다시 읽을 수 있습니다. 요청에 입력 텍스트는 포함되지 않으며 개발자 도구의 Network 탭에서 확인할 수 있습니다.

한국어는 어떤 토크나이저가 유리한가요?

이 페이지의 예에서는 o200k_base가 가장 적었습니다. 예시 문장 277자는 o200k_base 164, DeepSeek V4 176, cl100k_base 231 토큰이었습니다. 문장마다 차이가 있으니 실제 프롬프트로 비교하세요.

가격은 언제 기준인가요?

2026년 10월 1일 OpenAI, Anthropic, Google, DeepSeek 공식 가격 페이지에서 확인한 미국 달러 단가이며, 날짜를 표 아래에 표시합니다. 원화 환산은 하지 않습니다. 가격은 예고 없이 바뀌므로 예산을 잡기 전에 링크된 페이지를 확인하세요.