토큰 계산기
무료, 즉시, 가입 없음. 요청당 입력·출력·캐시 토큰 수와 월 요청량을 넣으면 Claude·GPT·Gemini 24개 모델의 요청당 비용과 월 비용을 한 번에 계산합니다. 각 모델 옆에 제공사 정가를 나란히 표시하며, 요율은 카탈로그에서 실시간으로 읽습니다.
Your workload
Rate: $1.20 in / $6.00 out · cache hit $0.1200 · cache write $1.50 — all per 1M tokens, read live from the Kunavo catalog.
Estimated cost
You save vs Anthropic list
$450/ month · ~60%
Estimate only. Reasoning models bill hidden reasoning tokens at the output rate, so a reasoning workload costs more than the output box suggests. Cache writes are billed separately at $1.50 per 1M and are not in this figure — they are a one-off per cache entry, not per request. Failed requests are never billed.
모델별 요금 가이드
캐시 읽기는 입력 요율의 10%
캐시 입력과 reasoning 토큰
Haiku / Sonnet / Opus 요율
Flash / Pro 요율과 무료 티어
GPT 모델별 요율
모든 모델을 API 하나로
장당 과금
전체 모델, 정가 대비
LLM 토큰 비용은 어떻게 계산하나요?
LLM API는 100만 토큰 단위로 과금하며 입력과 출력의 요율이 다릅니다. 따라서 요청 하나의 비용은 (입력 토큰 ÷ 1,000,000 × 입력 요율) + (출력 토큰 ÷ 1,000,000 × 출력 요율)입니다. 출력 요율이 입력의 몇 배인 것이 보통이라, 짧은 프롬프트에 긴 답변이 긴 프롬프트에 짧은 답변보다 비쌀 수 있습니다. 월 비용은 이 요청당 금액에 요청량을 곱한 값이고, 캐시된 입력은 입력 요율의 일부만 받는 세 번째 항으로 따로 계산합니다.
이 계산기가 텍스트의 토큰 수를 세어 주나요?
아닙니다. 이 계산기는 입력한 토큰 수에 요율을 적용할 뿐 토크나이징은 하지 않습니다. 요청당 입력·출력·캐시 토큰 수를 넣으면 요청당 비용과 월 비용을 돌려줍니다. 실제 토큰 수는 글자 수로 추정하지 말고 API 응답이 이미 돌려주는 usage 필드에서 읽으세요 — 글자 수 대비 토큰 비율은 언어와 토크나이저에 따라 크게 달라집니다.
이 토큰 계산기는 무료인가요?
무료입니다. 브라우저에서 바로 돌아가고 가입도 API 키도 필요 없습니다. 요율은 Kunavo 모델 카탈로그에서 실시간으로 읽어오며, 모델마다 제공사가 공표한 정가를 나란히 보여주므로 제공사 요금 페이지에서 직접 대조할 수 있습니다.
제 워크로드에는 어떤 LLM API가 가장 쌉니까?
입력 대 출력 비율에 따라 달라지며, 그래서 짐작하지 말고 비교해야 합니다. 긴 컨텍스트를 넣고 짧게 답하는 워크로드는 입력 요율이 지배하고, 긴 텍스트를 생성하는 워크로드는 출력 요율이 지배하는데 등급 간 격차는 출력 쪽이 가장 큽니다. 자신의 토큰 수를 넣고 월 비용 열을 보세요 — 요약 작업에서 가장 싼 모델이 대화 작업에서도 가장 싼 경우는 오히려 드뭅니다.
실제 청구액이 계산기보다 높은 이유는?
요청당 추정이 빠뜨리는 것이 세 가지입니다. 추론 모델의 thinking 토큰은 응답 본문에 나타나지 않지만 출력 요율로 과금됩니다. 캐시 쓰기는 캐시 항목마다 한 번씩 따로 과금되어 요청당 금액 밖에 있습니다. 그리고 재시도도 과금됩니다 — 토큰을 쓰고 나서 실패한 요청도 청구됩니다. 사용자가 보는 작업 하나가 과금상 여러 번의 왕복인 에이전트형 도구에서 격차가 가장 큽니다.