Novo — GPT-6 Astra, Gemini 3.8 Flash e Seedance 2.5 já no ar

Modelos de fronteira,
até 70 % abaixo do preço oficial.

Os modelos de fronteira da OpenAI, Anthropic e Google — Claude, Gemini, GPT-Image, Veo — a maioria abaixo do preço oficial do provedor, até 70 % mais barato conforme o modelo, atrás de uma única API compatível com OpenAI. Mude uma linha de base_url e está em produção.

Setup em 5 segundos · Sem cartão · Sem mínimo
Cole no seu AI agent
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model.

base_url:  https://api.kunavo.com/v1
auth:      Authorization: Bearer $KUNAVO_API_KEY

To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt

Provedores integrados

OpenAIAnthropicGoogle
37
Modelos disponíveis
até 70 %
Abaixo do preço oficial
$10
Recarga mínima
Automático
Failover multiprovedor
Por que Kunavo

O gateway de AI para devs que entregam.

Da camada de routing ao livro contábil de billing, cada camada do Kunavo é desenhada para devs indies e times pequenos que entregam features de AI a usuários reais.

Frente edge, hospedagem US-East

Uma rede edge Anycast termina o TLS perto de você; o gateway em si roda em uma única região US-East (Ashburn, Virgínia).

Compatível com OpenAI

Substituto drop-in para o SDK da OpenAI. Streaming, function calling, tool use, vision — tudo compatível no nível do protocolo. Sem cliente novo para aprender.

Billing nativo Stripe

Pix, cartões, Apple Pay, Link, Alipay, WeChat Pay — os métodos que o Stripe oferece em cobranças em USD. Recarga self-service, auto-recarga opcional, sem assinatura.

Modelos de fronteira, até 70 % mais barato

Cada modelo da OpenAI, Anthropic e Google, a maioria abaixo do preço de tabela oficial — até 70 % mais barato conforme o modelo. Claude, Gemini, GPT-Image, Veo — texto, imagem, vídeo em um só saldo.

Preço transparente

Preço por 1 M de tokens publicado para cada modelo. Sem multiplicadores ocultos, sem surpresas, requests que falham não são cobradas.

Failover automático

Cada request pode cair em cascata por até três canais upstream. Um canal que vem falhando é contornado antes mesmo de a sua request sair — sem retry no cliente.

Streaming de primeira classe

Implementação nativa SSE passthrough. Time-to-first-token igual ao upstream — sem buffering, sem batching, sem latência adicionada.

Uso granular

Analytics call-by-call por modelo, chave, IP. Webhooks quando uma tarefa de imagem, vídeo ou música termina. Exporte tudo em CSV quando quiser.

Prompt caching, até 90 % mais barato

Leituras de cache no Claude, GPT e Gemini são cobradas a 10 % da taxa de input — passe cache_control no seu system prompt e contextos longos viram re-leituras quase grátis. Hit rate e economia em tempo real no dashboard.

Catálogo de modelos

Modelos de fronteira, até 70 % abaixo do oficial.

Ver catálogo completo
Anthropic

Claude Fable 5

30%+ OFF

Frontier reasoning and long-horizon agents — the model Fable 5.1 succeeds.

visionfunctionstreamingthinking
$7.00/$35.00
$10 / $50per 1M tokens
Anthropic

Claude Opus 5

60%+ OFFnew

Near-flagship Opus reasoning at half the price of Fable 5 — vision and agentic coding.

visionfunctionstreamingthinking
$2.00/$10.00
$5 / $25per 1M tokens
Anthropic

Claude Opus 4.8

50%+ OFF

Anthropic Opus 4.8 — stronger agentic coding and honesty.

visionfunctionstreamingthinking
$2.50/$12.50
$5 / $25per 1M tokens
Anthropic

Claude Opus 4.7

60%+ OFF

Anthropic Opus 4.7 — previous-generation Opus; reasoning and vision.

visionfunctionstreamingthinking
$2.00/$10.00
$5 / $25per 1M tokens
Anthropic

Claude Opus 4.6

60%+ OFF

Anthropic Opus 4.6 — deep reasoning, exceptional agentic ability.

visionfunctionstreamingthinking
$2.00/$10.00
$5 / $25per 1M tokens
Anthropic

Claude Sonnet 5

Near-Opus coding and agentic quality at Sonnet cost.

visionfunctionstreamingthinking
$2.00/$10.00
$2 / $10per 1M tokens
Anthropic

Claude Sonnet 4.6

60%+ OFFhot

Balanced speed/quality — the everyday production workhorse, elite coding.

visionfunctionstreamingthinking
$1.20/$6.00
$3 / $15per 1M tokens
Anthropic

Claude Haiku 4.5

60%+ OFF

Anthropic Haiku 4.5 — fast and cost-efficient.

visionfunctionstreaming
$0.40/$2.00
$1 / $5per 1M tokens
Google

Gemini 3.8 Flash

65%+ OFFnew

Google's newest Flash — long-horizon software engineering and agentic execution.

visionfunctionstreamingthinking
$0.525/$2.625
$1.5 / $7.5per 1M tokens
Google

Gemini 3.7 Flash

65%+ OFFnew

Google's newest Flash — stronger coding and agentic execution at half the 3.6 official rate.

visionfunctionstreamingthinking
$0.525/$2.625
$1.5 / $7.5per 1M tokens
Google

Gemini 3.6 Flash

30%+ OFFnew

Gemini 3.6 Flash — thinking-by-default at Flash latency, with native audio input.

visionfunctionstreamingthinking
$1.05/$5.25
$1.5 / $7.5per 1M tokens
Google

Gemini 3.1 Pro

65%+ OFF

Gemini 3.1 Pro — Google's flagship for coding, agents, and cross-modal analysis.

visionfunctionstreamingthinking
$0.70/$4.20
$2 / $12per 1M tokens
Google

Gemini 2.5 Flash

70%+ OFF

Previous-gen Gemini Flash — extreme value.

visionfunctionstreaminglong-context
$0.09/$0.75
$0.3 / $2.5per 1M tokens
OpenAI

GPT-6 Astra

60%+ OFFnew

OpenAI's newest flagship — frontier reasoning and long-horizon agentic coding.

functionstreamingthinkinglong-context
$4.00/$20.00
$10 / $50per 1M tokens
OpenAI

GPT-5.6 Sol

60%+ OFF

OpenAI's newest flagship — top-tier reasoning and agentic coding.

functionstreamingthinkinglong-context
$2.00/$12.00
$5 / $30per 1M tokens
OpenAI

GPT-5.6 Terra

65%+ OFF

GPT-5.6 mid tier — the everyday workhorse of the 5.6 family.

functionstreamingthinkinglong-context
$0.70/$4.20
$2 / $12per 1M tokens
OpenAI

GPT-5.6 Luna

65%+ OFF

GPT-5.6 fast tier — high-volume, low-latency execution at mini-class cost.

functionstreaminglong-context
$0.07/$0.42
$0.2 / $1.2per 1M tokens
OpenAI

GPT-5.5

60%+ OFF

OpenAI GPT-5.5 — flagship reasoning and agentic tool use.

functionstreamingthinkinglong-context
$2.00/$12.00
$5 / $30per 1M tokens
Para AI agents

Aponte seu agente para llms.txt
e ele se vira sozinho.

Dê ao Claude Code, Cursor, Cline — ou qualquer agente compatível com OpenAI — uma única instrução. Ele carregará o catálogo ao vivo do Kunavo e operará modelos de texto, imagem e vídeo autonomamente. Sem SDK, sem glue code.

  • Compatível com o protocolo OpenAI — agentes não precisam de integração custom
  • GET /v1/models é o catálogo ao vivo — nunca hardcode nomes de modelo
  • Uma chave, todas as modalidades: texto, imagem, vídeo, áudio
Cole no seu AI agent
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model.

base_url:  https://api.kunavo.com/v1
auth:      Authorization: Bearer $KUNAVO_API_KEY

To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt
Recarregue e economize

Quanto mais você recarrega adiantado, mais economiza.

Carteira pré-paga. A partir de $10. Sem assinatura, sem mínimo, saldo nunca expira.

Starter

Primeiros testes

$10
  • Acesso a todos os modelos e endpoints
  • Analytics call-by-call
  • Suporte por e-mail
  • Sem assinatura, sem validade — a partir de $10
Cadastro grátis
Most popular

Builder

Limitado · +$10

Você está construindo um produto

$100
  • $110 de crédito ao recarregar $100
  • 10 % de bônus, por tempo limitado
  • Suporte por e-mail prioritário
  • Tudo o que qualquer conta recebe
Recarregar $100

Scale

Limitado · +$250

Tráfego em produção

$1000
  • $1.250 de crédito ao recarregar $1.000
  • 25 % de bônus, por tempo limitado
  • Suporte por e-mail prioritário
  • Tudo o que qualquer conta recebe
Recarregar $1000

Enterprise

Limitado · +$2000

Grande escala

$5000
  • $7.000 de crédito ao recarregar $5.000
  • 40 % de bônus, por tempo limitado
  • Suporte por e-mail prioritário
  • Tudo o que qualquer conta recebe
Recarregar $5000

Incluído em toda conta

  • Chaves de API ilimitadas
  • Limite de gasto mensal por chave
  • Allowlist de IP por chave
  • Auto-recarga com cartão salvo — qualquer valor a partir de $10, opt-in
  • Webhooks para tarefas de imagem, vídeo e música
  • API de uso e exportação CSV
  • Endpoints compatíveis com OpenAI e Anthropic Messages
Guides

Start with the popular guides.

Browse all guides
FAQ

Tudo que você
se pergunta.

Não encontrou resposta? Escreva para contact@kunavo.com — respondemos em 24 horas.

  • O Kunavo foi feito especificamente para devs indies e times pequenos que entregam features de AI em produção. Três diferenças reais: (1) cobrimos texto, imagem, vídeo e música com um único saldo; (2) checkout nativo Stripe, Alipay, Apple Pay, WeChat Pay tudo incluso — sem faturas fora da plataforma; (3) transparência total no routing — nunca trocamos silenciosamente seu modelo por um mais barato.

  • A maioria dos modelos fica abaixo do preço oficial do provedor — até 70 % mais barato conforme o modelo; alguns ficam no preço de tabela, e a página de cada modelo diz isso. Recargas maiores liberam bônus adicional. Você também economiza operacionalmente: uma conta, um saldo, um SDK, sem mínimo de compromisso. O preço por 1 M de tokens de cada modelo está publicado em /pricing — comparável com o listing upstream a qualquer momento.

  • Sim. Implementamos o conjunto completo de endpoints da OpenAI: /v1/chat/completions, /v1/embeddings, /v1/images/generations, /v1/models e /v1/video/generations. Streaming, function calling, vision e tool use se comportam identicamente. Projetos que usam o SDK da OpenAI migram trocando base_url — é só isso.

  • Não. O Kunavo é uma carteira pré-paga. Recargas permanecem na sua conta para sempre — sem assinatura, sem mínimo mensal, sem expiração. Fechamento de conta reembolsa o saldo restante no método de pagamento original.

  • Nunca. Respostas 4xx e 5xx não são cobradas. Respostas em streaming que desconectam no meio são cobradas apenas pelos tokens efetivamente entregues. Cada cobrança é visível call-by-call no dashboard de uso e exportável em CSV para contabilidade.

  • Pix (valor exibido em reais, compensação imediata — não exige cartão de crédito internacional), cartões (Visa, Mastercard, Amex, JCB, UnionPay), Apple Pay, Link, Cash App Pay, Klarna, Amazon Pay, Alipay e WeChat Pay. O Stripe converte o preço em USD para reais no checkout, então o Pix aparece com o valor já em BRL. Débito SEPA, BACS e BECS não estão entre os métodos que aceitamos. A auto-recarga é opt-in e funciona só com cartão: salve um cartão uma vez e o saldo se recarrega sozinho no valor que você escolher, a partir de $10.

  • O Kunavo roda em uma única região US-East (Ashburn, Virgínia) atrás de um edge anycast que termina o TLS perto de você. Contas, cobrança e dados de uso ficam em um único banco de dados primário, com snapshots de volume criptografados diários.

Três minutos até sua primeira chamada.

Uma única API compatível com OpenAI para Claude, Gemini, GPT-Image, Veo e Suno — recarga mínima de $10, você paga só pelo que chamar.