전체 도구도구

토큰 계산기

무료, 즉시, 가입 없음. 요청당 입력·출력·캐시 토큰 수와 월 요청량을 넣으면 Claude·GPT·Gemini 24개 모델의 요청당 비용과 월 비용을 한 번에 계산합니다. 각 모델 옆에 제공사 정가를 나란히 표시하며, 요율은 카탈로그에서 실시간으로 읽습니다.

Your workload

Quick presets

Rate: $1.20 in / $6.00 out · cache hit $0.1200 · cache write $1.50 — all per 1M tokens, read live from the Kunavo catalog.

Estimated cost

Per request$0.00300
Per month (Kunavo)$300
Per month at Anthropic list$750

You save vs Anthropic list

$450/ month · ~60%

Estimate only. Reasoning models bill hidden reasoning tokens at the output rate, so a reasoning workload costs more than the output box suggests. Cache writes are billed separately at $1.50 per 1M and are not in this figure — they are a one-off per cache entry, not per request. Failed requests are never billed.

더 알아보기

모델별 요금 가이드

FAQ

LLM 토큰 비용은 어떻게 계산하나요?

LLM API는 100만 토큰 단위로 과금하며 입력과 출력의 요율이 다릅니다. 따라서 요청 하나의 비용은 (입력 토큰 ÷ 1,000,000 × 입력 요율) + (출력 토큰 ÷ 1,000,000 × 출력 요율)입니다. 출력 요율이 입력의 몇 배인 것이 보통이라, 짧은 프롬프트에 긴 답변이 긴 프롬프트에 짧은 답변보다 비쌀 수 있습니다. 월 비용은 이 요청당 금액에 요청량을 곱한 값이고, 캐시된 입력은 입력 요율의 일부만 받는 세 번째 항으로 따로 계산합니다.

이 계산기가 텍스트의 토큰 수를 세어 주나요?

아닙니다. 이 계산기는 입력한 토큰 수에 요율을 적용할 뿐 토크나이징은 하지 않습니다. 요청당 입력·출력·캐시 토큰 수를 넣으면 요청당 비용과 월 비용을 돌려줍니다. 실제 토큰 수는 글자 수로 추정하지 말고 API 응답이 이미 돌려주는 usage 필드에서 읽으세요 — 글자 수 대비 토큰 비율은 언어와 토크나이저에 따라 크게 달라집니다.

이 토큰 계산기는 무료인가요?

무료입니다. 브라우저에서 바로 돌아가고 가입도 API 키도 필요 없습니다. 요율은 Kunavo 모델 카탈로그에서 실시간으로 읽어오며, 모델마다 제공사가 공표한 정가를 나란히 보여주므로 제공사 요금 페이지에서 직접 대조할 수 있습니다.

제 워크로드에는 어떤 LLM API가 가장 쌉니까?

입력 대 출력 비율에 따라 달라지며, 그래서 짐작하지 말고 비교해야 합니다. 긴 컨텍스트를 넣고 짧게 답하는 워크로드는 입력 요율이 지배하고, 긴 텍스트를 생성하는 워크로드는 출력 요율이 지배하는데 등급 간 격차는 출력 쪽이 가장 큽니다. 자신의 토큰 수를 넣고 월 비용 열을 보세요 — 요약 작업에서 가장 싼 모델이 대화 작업에서도 가장 싼 경우는 오히려 드뭅니다.

실제 청구액이 계산기보다 높은 이유는?

요청당 추정이 빠뜨리는 것이 세 가지입니다. 추론 모델의 thinking 토큰은 응답 본문에 나타나지 않지만 출력 요율로 과금됩니다. 캐시 쓰기는 캐시 항목마다 한 번씩 따로 과금되어 요청당 금액 밖에 있습니다. 그리고 재시도도 과금됩니다 — 토큰을 쓰고 나서 실패한 요청도 청구됩니다. 사용자가 보는 작업 하나가 과금상 여러 번의 왕복인 에이전트형 도구에서 격차가 가장 큽니다.