Calculadora de tokens
Grátis, instantânea e sem cadastro. Informe os tokens de entrada, de saída e em cache por requisição e o volume mensal, e veja o custo por requisição e por mês de 24 modelos Claude, GPT e Gemini — cada um ao lado do preço de tabela do fornecedor. Os preços vêm do catálogo em tempo real.
Your workload
Rate: $1.20 in / $6.00 out · cache hit $0.1200 · cache write $1.50 — all per 1M tokens, read live from the Kunavo catalog.
Estimated cost
You save vs Anthropic list
$450/ month · ~60%
Estimate only. Reasoning models bill hidden reasoning tokens at the output rate, so a reasoning workload costs more than the output box suggests. Cache writes are billed separately at $1.50 per 1M and are not in this figure — they are a one-off per cache entry, not per request. Failed requests are never billed.
Guias de preço por família de modelos
Leitura de cache a um décimo da entrada
Entrada em cache e tokens de raciocínio
Preços de Haiku / Sonnet / Opus
Flash / Pro e o nível gratuito
Preços do GPT por modelo
Uma API para todos os modelos
Preço por imagem
Todos os modelos, contra a tabela oficial
Como calcular o custo de tokens de uma API de LLM?
As APIs de LLM cobram por milhão de tokens, com preços diferentes para entrada e saída. O custo de uma requisição é (tokens de entrada ÷ 1.000.000 × preço de entrada) + (tokens de saída ÷ 1.000.000 × preço de saída). A saída costuma custar várias vezes mais que a entrada, por isso um prompt curto com uma resposta longa pode sair mais caro que um prompt longo com uma resposta curta. O custo mensal é esse valor multiplicado pelo volume de requisições, e a entrada em cache entra como um terceiro termo, a uma fração do preço de entrada.
A calculadora de tokens conta os tokens de um texto?
Não. A calculadora aplica os preços aos números de tokens que você informa; ela não faz a tokenização de texto. Informe os tokens de entrada, de saída e em cache por requisição e ela devolve o custo por requisição e por mês. Para saber os tokens reais do seu tráfego, leia o campo usage que as respostas da API já trazem, em vez de estimar pelo número de caracteres: a proporção entre caracteres e tokens muda com o idioma e com o tokenizador, e um texto em português costuma virar mais tokens que o mesmo conteúdo em inglês.
A calculadora é gratuita?
Sim. A calculadora de tokens é gratuita, roda no navegador e não pede cadastro nem chave de API. Os preços são lidos em tempo real do catálogo de modelos da Kunavo, e cada modelo aparece ao lado do preço de tabela publicado pelo fornecedor, então dá para conferir a comparação na página de preços do próprio fornecedor.
Qual API de LLM sai mais barata para o meu caso?
Depende da proporção entre entrada e saída — e é por isso que vale comparar em vez de supor. Uma aplicação que envia muito contexto e recebe respostas curtas é dominada pelo preço de entrada; uma que gera textos longos é dominada pela saída, onde a diferença entre os modelos é maior. Coloque os seus próprios números e olhe a coluna mensal: o modelo mais barato para resumir documentos raramente é também o mais barato para um chat.
Por que a fatura real sai maior do que a calculadora mostra?
Porque uma estimativa por requisição deixa três coisas de fora. Os tokens de raciocínio são cobrados como saída, embora não apareçam na resposta. A gravação em cache é cobrada uma vez por entrada de cache e fica fora do valor por requisição. E as repetições contam: uma requisição concluída consome tokens e é cobrada mesmo que você descarte o resultado e tente de novo. A diferença é maior em ferramentas agênticas, porque uma tarefa que o usuário vê são muitas idas e voltas cobradas.
Os valores estão em dólar ou em real?
Em dólar (USD), a moeda em que os preços por token são definidos; a calculadora não converte para reais. Para recarregar o saldo pré-pago, o checkout aceita Pix no Brasil, além de cartões internacionais e Apple Pay. A recarga mínima é de US$ 10 e o saldo não expira.