클로드 토큰 계산기
무료, 즉시, 가입 없음. 요청당 입력·출력·캐시 토큰 수와 월 요청량을 넣으면 Claude 전 등급의 요청당·월 비용이 나옵니다. 캐시 읽기는 입력 요율의 10%로 계산하며, 에이전트 청구액의 대부분이 실제로 그 항목에서 나옵니다.
Your workload
Rate: $1.20 in / $6.00 out · cache hit $0.1200 · cache write $1.50 — all per 1M tokens, read live from the Kunavo catalog.
Estimated cost
You save vs Anthropic list
$130/ month · ~60%
Caching accounts for $130 / month of that — 24,000 of your 30,000 input tokens billed at $0.1200 instead of $1.20 per 1M.
Estimate only. Reasoning models bill hidden reasoning tokens at the output rate, so a reasoning workload costs more than the output box suggests. Cache writes are billed separately at $1.50 per 1M and are not in this figure — they are a one-off per cache entry, not per request. Failed requests are never billed.
숫자를 움직이는 것은 캐시 행입니다
채팅 제품의 Claude 청구서는 입력 + 출력이라는 두 항 공식에 거의 맞습니다. 프롬프트가 매번 다르니 캐시가 거의 영향을 주지 않기 때문입니다. 에이전트 쪽은 다릅니다. 코딩 에이전트는 매 턴마다 시스템 프롬프트와 도구 정의, 저장소 맵을 다시 보내므로 같은 수만 개의 토큰을 반복해서 지불하게 됩니다 — 캐시에 태우지 않으면. 태우면 그 부분은 10분의 1 가격이 됩니다.
그래서 이 계산기는 캐시 토큰을 별도 항목이 아니라 입력의 부분집합으로 받습니다. 0으로 두면 다른 계산기와 같은 답이 나오고, 턴 사이에 고정되는 프롬프트의 비율을 넣으면 실제 청구서에 가까운 답이 나옵니다.
Anthropic에 직접 호출할 때와 다른 두 가지 요율
첫째는 눈에 보이는 쪽입니다. 이 페이지의 모든 Claude 모델은 Anthropic 공표 요율과 나란히 표시되므로, 차이는 주장이 아니라 대조로 확인할 수 있습니다.
둘째는 조용하고 캐시를 많이 쓰는 작업에서만 드러납니다. Anthropic은 캐시 항목을 쓸 때 입력 요율 위에 할증을 붙입니다 — 5분 캐시는 1.25배, 1시간 캐시는 2배입니다. Kunavo는 1시간 캐시를 포함한 모든 캐시 쓰기를 해당 모델 입력 요율의 1.25배로 과금하며, 입력과 같은 정가 대비 할인이 그대로 적용됩니다. 하루에도 여러 번 캐시를 다시 만드는 장문 컨텍스트 에이전트에서는 이것이 실제 항목이 되며, 계산기 아래 각주가 캐시 쓰기 요율을 감추지 않고 명시하는 이유이기도 합니다.
두 요율 모두 렌더링 시점에 카탈로그에서 읽습니다 — 요금 표와 캐싱 문서가 읽는 것과 같은 출처입니다. 이 페이지에 손으로 적은 가격은 없습니다.
Claude 요금, 더 깊이
등급별 요율, 정가와 나란히
켜는 방법과 요율
게이트웨이에서 적중률이 떨어지는 이유
Claude·GPT·Gemini 한자리에
구독 대 API
한도에 걸리면 생기는 일
작업당 실측 비용
전체 모델, 정가 대비
Claude API 비용은 어떻게 계산하나요?
Claude는 100만 토큰 단위로 과금하며 입력과 출력 요율이 다릅니다. 요청 하나는 (입력 토큰 ÷ 1,000,000 × 입력 요율) + (출력 토큰 ÷ 1,000,000 × 출력 요율)입니다. Claude 등급 전반에서 출력이 입력의 약 다섯 배라, 짧은 프롬프트에 긴 답변이 긴 프롬프트에 짧은 답변보다 비쌀 수 있습니다. 프롬프트 캐싱이 세 번째 항을 더합니다: 캐시에서 제공되는 토큰은 입력 요율의 10분의 1로 과금되므로, 같은 컨텍스트를 반복해서 보내는 작업은 두 항 공식이 말하는 것보다 쌉니다.
Claude 캐시 적중은 얼마인가요?
Kunavo에서 캐시 읽기는 해당 모델 입력 요율의 0.10배로 과금되며, Anthropic 자신의 캐시 읽기 비율과 같습니다. 30,000 토큰 프롬프트 안에 24,000 토큰짜리 저장소 맵을 매 턴 다시 보내는 코딩 에이전트라면 입력의 80%가 10분의 1 가격이 되는 셈입니다. 대부분의 작업에서 이것은 더 싼 등급으로 내리는 것보다 큰, 에이전트 청구서의 단일 최대 레버입니다.
Kunavo는 Claude 프롬프트 캐시 쓰기에 추가 요금을 받나요?
받습니다 — Anthropic이 5분 캐시 쓰기에 매기는 것과 같은 1.25배를 해당 모델의 Kunavo 입력 요율에 적용하므로, 캐시 쓰기에도 입력과 같은 정가 대비 할인이 그대로 붙습니다. 다른 점은 1시간 캐시 하나입니다: Anthropic은 그 쓰기를 입력의 2배로 매기지만 Kunavo는 같은 1.25배로 과금합니다. 이 값은 코드 한 곳에서 정해지며(Claude 모델의 쓰기 비율은 1.25), 계산기 아래 표시되는 캐시 쓰기 수치도 손으로 적은 것이 아니라 그 값에서 읽어옵니다. 따라서 API가 실제로 받지 않는 요율을 이 페이지가 인용할 수 없습니다.
코딩 에이전트에는 어떤 Claude 모델이 가장 쌉니까?
토큰당으로는 Haiku가 가장 싸지만, 끝낸 작업당으로 가장 싼 것은 보통 단일 모델이 아니라 분담입니다: 편집에는 상위 등급을, 클라이언트가 알아서 띄우는 백그라운드 하위 작업에는 Haiku를 씁니다. Claude Code는 그 하위 작업을 이미 Haiku 등급에 매핑된 모델로 보내므로, 그 매핑을 지정하는 편이 메인 모델을 바꾸는 것보다 이득이 큽니다. 위에서 두 작업을 따로 넣어 비교해 보세요.
이 계산기가 붙여넣은 텍스트의 토큰을 세어 주나요?
아닙니다. 이 계산기는 입력한 토큰 수에 요율을 적용할 뿐 토크나이징은 하지 않습니다. 글자 수 기반 추정은 언어와 토크나이저에 따라 크게 어긋나기 때문에 의도적으로 넣지 않았습니다. 실제 수치는 API 응답이 이미 돌려주는 usage 필드에서 캐시 읽기 수치까지 함께 읽어 넣으세요.
실제 Claude 청구액이 이 추정보다 높은 이유는?
요청당 추정이 빠뜨리는 것이 세 가지입니다. 확장 사고(extended thinking)의 추론 토큰은 응답에 나타나지 않지만 출력 요율로 과금됩니다. 캐시 쓰기는 캐시 항목마다 한 번씩 과금되어 위의 요청당 수치 밖에 있습니다. 그리고 재시도도 과금됩니다 — 토큰을 쓰고 나서 하류에서 실패한 요청도 청구됩니다. 사용자가 보는 작업 하나가 과금상 여러 번의 왕복인 에이전트형 도구에서 격차가 가장 큽니다.