전체 도구도구

OpenAI API 요금 계산기

무료, 즉시, 가입 없음. 요청당 입력·출력·캐시 토큰 수와 월 요청량을 넣으면 GPT의 요청당·월 비용이 나옵니다. 캐시 입력은 입력 요율의 10분의 1로 계산하고, 각 모델을 OpenAI 정가와 나란히 표시합니다.

Your workload

Quick presets

Rate: $0.7000 in / $4.20 out · cache hit $0.0700 · cache write $0.8750 — all per 1M tokens, read live from the Kunavo catalog.

Estimated cost

Per request$0.00252
Per month (Kunavo)$252
Per month at OpenAI list$720

You save vs OpenAI list

$468/ month · ~65%

Estimate only. Reasoning models bill hidden reasoning tokens at the output rate, so a reasoning workload costs more than the output box suggests. Cache writes are billed separately at $0.8750 per 1M and are not in this figure — they are a one-off per cache entry, not per request. Failed requests are never billed.

단순 추정을 깨뜨리는 두 개의 항

입력 × 요율 + 출력 × 요율은 2023년 청구서를 잘 설명하는 모델입니다. 지금의 GPT 모델에서는 양쪽으로 동시에 빗나갑니다.

캐시 입력은 실제 금액을 아래로 끌어내립니다. 앞부분이 고정된 프롬프트 —— 시스템 메시지, 도구 스키마, 질문 다섯 개를 던지는 문서 —— 는 그 앞부분이 캐시에서 제공되며, OpenAI 프로토콜에서는 입력 요율의 0.10배로 과금됩니다. 800 토큰짜리 레코드마다 같은 4,000 토큰 지시문을 함께 보내는 분류 작업은 대부분이 캐시이고, 두 항 추정은 그 비용을 크게 부풀립니다.

reasoning 토큰은 위로 밀어 올리고, 폭이 더 큽니다. 출력 요율로 과금되지만 돌려주지 않으므로, 어떤 계산기든 —— 이것을 포함해 —— 출력 칸에 눈에 보이는 답변 길이를 넣으면 틀린 숫자가 나옵니다. 청구된 출력 토큰 수를 넣어야 합니다. 실제 청구서가 추정을 넘어서는 가장 흔한 이유가 바로 이것입니다.

요율의 출처

이 페이지의 모든 요율은 렌더링 시점에 Kunavo 카탈로그에서 읽습니다 —— 요금 표, 캐싱 문서, 모델 페이지가 읽는 것과 같은 출처입니다. 그리고 모델마다 OpenAI가 공표한 정가를 나란히 찍으므로, 비교는 주장이 아니라 대조로 확인됩니다. 카탈로그에서 요율이 바뀌면 같은 배포에서 여기도 바뀝니다. 손으로 적은 가격은 없습니다.

Anthropic 프로토콜은 캐시 경제가 다릅니다 —— 읽기는 똑같이 입력의 10분의 1이지만 Claude는 모든 캐시 쓰기를 입력의 1.25배로 과금하고, GPT 쪽에서 쓰기 요율이 따로 있는 모델은 GPT-5.6과 GPT-6 Astra뿐입니다. 그래서 Claude 모델은 필터를 붙인 공용 계산기가 아니라 자체 계산기를 씁니다.

더 알아보기

OpenAI 요금, 더 깊이

FAQ

OpenAI API 비용은 어떻게 계산하나요?

OpenAI는 100만 토큰 단위로 입력과 출력에 각각 다른 요율을 매깁니다. 요청 하나는 (입력 토큰 ÷ 1,000,000 × 입력 요율) + (출력 토큰 ÷ 1,000,000 × 출력 요율)이고, 월 비용은 여기에 요청량을 곱한 값입니다. 최신 모델에서는 이 공식에 두 항이 빠져 있습니다: 입력 요율의 일부만 받는 캐시 입력과, 출력 요율로 과금되지만 응답 본문에는 전혀 나타나지 않는 reasoning 토큰입니다.

캐시 입력이 무엇이고 얼마인가요?

캐시 입력은 요청마다 반복되는 프롬프트의 앞부분입니다 —— 시스템 프롬프트, 도구 스키마, 긴 문서 —— 제공사가 다시 처리하는 대신 캐시에서 내줄 수 있는 부분입니다. Kunavo에서 OpenAI 프로토콜 모델의 캐시 입력은 해당 모델 입력 요율의 0.10배로 과금되므로, 입력과 같은 정가 대비 할인이 그대로 적용됩니다. 프롬프트에 고정된 앞부분이 있다면 위의 캐시 칸에 현실적인 값을 넣는 편이 좋습니다. 반복이 많은 작업일수록 단순한 두 항 추정이 크게 부풀려 나오기 때문입니다.

reasoning 모델이 출력 칸이 시사하는 것보다 비싼 이유는?

reasoning 모델은 출력 요율로 과금되지만 돌려주지 않는 내부 토큰을 생성합니다. 눈에 보이는 답변이 400 토큰인 작업이 수천 토큰으로 청구될 수 있습니다. 이 계산기는 당신의 프롬프트에서 그 비율이 얼마인지 알 수 없으므로, 정직한 사용법은 눈에 보이는 답변 길이가 아니라 자신의 usage 데이터에 찍힌 청구 출력 토큰 총량을 출력 칸에 넣는 것입니다.

OpenAI API가 ChatGPT 구독보다 싼가요?

전적으로 사용량에 달렸고, 교차점은 짐작하지 말고 계산하면 됩니다: 구독 가격을 이 계산기가 알려준 요청당 비용으로 나누면, 구독이 본전을 뽑기 위해 한 달에 몇 번의 요청을 대신해 줘야 하는지가 나옵니다. 가볍고 들쭉날쭉한 사용은 API가 유리하고, 매일 꾸준히 무겁게 쓰면 정액 구독이 유리합니다. 코딩 워크로드에 대한 같은 계산은 Codex 요금 가이드가 끝까지 풀어 놓았습니다.

이 계산기가 붙여넣은 텍스트의 토큰을 세어 주나요?

아닙니다. 이 계산기는 입력한 토큰 수에 요율을 적용할 뿐 토크나이징은 하지 않습니다. 글자 수 기반 추정은 언어와 토크나이저에 따라 크게 어긋나므로, 믿을 만한 출처는 API 응답이 이미 돌려주는 usage 객체입니다. 거기에는 프롬프트 토큰, 완성 토큰, 캐시된 부분이 각각 따로 적혀 있습니다.

이 OpenAI 요금 계산기는 무료인가요?

무료입니다. 전부 브라우저에서 돌아가고 가입도 API 키도 필요 없으며, 입력한 내용은 업로드되지 않습니다. 요율은 Kunavo 모델 카탈로그에서 실시간으로 읽고 모델마다 OpenAI가 공표한 정가를 나란히 보여주므로, 비교를 그냥 믿는 대신 OpenAI 요금 페이지에서 직접 대조할 수 있습니다.