Modelos de fronteira,
até 70 % abaixo do preço oficial.
Os modelos de fronteira da OpenAI, Anthropic e Google — Claude, Gemini, GPT-Image, Veo — a maioria abaixo do preço oficial do provedor, até 70 % mais barato conforme o modelo, atrás de uma única API compatível com OpenAI. Mude uma linha de base_url e está em produção.
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model. base_url: https://api.kunavo.com/v1 auth: Authorization: Bearer $KUNAVO_API_KEY To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt
Provedores integrados
O gateway de AI para devs que entregam.
Da camada de routing ao livro contábil de billing, cada camada do Kunavo é desenhada para devs indies e times pequenos que entregam features de AI a usuários reais.
Frente edge, hospedagem US-East
Uma rede edge Anycast termina o TLS perto de você; o gateway em si roda em uma única região US-East (Ashburn, Virgínia).
Compatível com OpenAI
Substituto drop-in para o SDK da OpenAI. Streaming, function calling, tool use, vision — tudo compatível no nível do protocolo. Sem cliente novo para aprender.
Billing nativo Stripe
Pix, cartões, Apple Pay, Link, Alipay, WeChat Pay — os métodos que o Stripe oferece em cobranças em USD. Recarga self-service, auto-recarga opcional, sem assinatura.
Modelos de fronteira, até 70 % mais barato
Cada modelo da OpenAI, Anthropic e Google, a maioria abaixo do preço de tabela oficial — até 70 % mais barato conforme o modelo. Claude, Gemini, GPT-Image, Veo — texto, imagem, vídeo em um só saldo.
Preço transparente
Preço por 1 M de tokens publicado para cada modelo. Sem multiplicadores ocultos, sem surpresas, requests que falham não são cobradas.
Failover automático
Cada request pode cair em cascata por até três canais upstream. Um canal que vem falhando é contornado antes mesmo de a sua request sair — sem retry no cliente.
Streaming de primeira classe
Implementação nativa SSE passthrough. Time-to-first-token igual ao upstream — sem buffering, sem batching, sem latência adicionada.
Uso granular
Analytics call-by-call por modelo, chave, IP. Webhooks quando uma tarefa de imagem, vídeo ou música termina. Exporte tudo em CSV quando quiser.
Prompt caching, até 90 % mais barato
Leituras de cache no Claude, GPT e Gemini são cobradas a 10 % da taxa de input — passe cache_control no seu system prompt e contextos longos viram re-leituras quase grátis. Hit rate e economia em tempo real no dashboard.
What to build with Kunavo.
- Customer Support
AI customer support
The fastest-ROI AI deployment in any B2C SaaS — automate ticket triage, draft 80% of responses, and escalate the rest cleanly. Production code, real cost numbers, and the compliance pitfalls that catch teams off-guard.
Explore - Knowledge Base
RAG chatbot API
Most internal knowledge bases are dead documentation — nobody finds anything. A Claude-backed RAG chatbot turns them into a real assistant that cites sources and refuses when it doesn't know. Here's the production pattern.
Explore - Trust & Safety
AI content moderation
Modern moderation isn't just regex — it's nuance: sarcasm, dog whistles, brand-context misuse, image+text combinations. LLMs do this far better than rule-based systems, at a price that scales.
Explore - Developer Tools
AI code assistant
Cursor, Aider, Cline, Continue.dev — they're all powered by the same handful of frontier LLMs. If you're building a coding tool (or a co-pilot inside your own dev product), here's the architecture and the cost reality.
Explore - Data Processing
AI data extraction
The boring, valuable use case. Invoices, receipts, contracts, leads, resumes — anywhere you'd previously have built a parser, an LLM with JSON-mode does it in 30 lines, more accurately, and you can ship in a day instead of a quarter.
Explore
Modelos de fronteira, até 70 % abaixo do oficial.
Claude Fable 5
Frontier reasoning and long-horizon agents — the model Fable 5.1 succeeds.
Claude Opus 5
Near-flagship Opus reasoning at half the price of Fable 5 — vision and agentic coding.
Claude Opus 4.8
Anthropic Opus 4.8 — stronger agentic coding and honesty.
Claude Opus 4.7
Anthropic Opus 4.7 — previous-generation Opus; reasoning and vision.
Claude Opus 4.6
Anthropic Opus 4.6 — deep reasoning, exceptional agentic ability.
Claude Sonnet 5
Near-Opus coding and agentic quality at Sonnet cost.
Claude Sonnet 4.6
Balanced speed/quality — the everyday production workhorse, elite coding.
Claude Haiku 4.5
Anthropic Haiku 4.5 — fast and cost-efficient.
Gemini 3.8 Flash
Google's newest Flash — long-horizon software engineering and agentic execution.
Gemini 3.7 Flash
Google's newest Flash — stronger coding and agentic execution at half the 3.6 official rate.
Gemini 3.6 Flash
Gemini 3.6 Flash — thinking-by-default at Flash latency, with native audio input.
Gemini 3.1 Pro
Gemini 3.1 Pro — Google's flagship for coding, agents, and cross-modal analysis.
Gemini 2.5 Flash
Previous-gen Gemini Flash — extreme value.
GPT-6 Astra
OpenAI's newest flagship — frontier reasoning and long-horizon agentic coding.
GPT-5.6 Sol
OpenAI's newest flagship — top-tier reasoning and agentic coding.
GPT-5.6 Terra
GPT-5.6 mid tier — the everyday workhorse of the 5.6 family.
GPT-5.6 Luna
GPT-5.6 fast tier — high-volume, low-latency execution at mini-class cost.
GPT-5.5
OpenAI GPT-5.5 — flagship reasoning and agentic tool use.
Aponte seu agente para llms.txt
e ele se vira sozinho.
Dê ao Claude Code, Cursor, Cline — ou qualquer agente compatível com OpenAI — uma única instrução. Ele carregará o catálogo ao vivo do Kunavo e operará modelos de texto, imagem e vídeo autonomamente. Sem SDK, sem glue code.
- Compatível com o protocolo OpenAI — agentes não precisam de integração custom
- GET /v1/models é o catálogo ao vivo — nunca hardcode nomes de modelo
- Uma chave, todas as modalidades: texto, imagem, vídeo, áudio
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model. base_url: https://api.kunavo.com/v1 auth: Authorization: Bearer $KUNAVO_API_KEY To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt
Quanto mais você recarrega adiantado, mais economiza.
Carteira pré-paga. A partir de $10. Sem assinatura, sem mínimo, saldo nunca expira.
Starter
Primeiros testes
- Acesso a todos os modelos e endpoints
- Analytics call-by-call
- Suporte por e-mail
- Sem assinatura, sem validade — a partir de $10
Builder
Limitado · +$10Você está construindo um produto
- $110 de crédito ao recarregar $100
- 10 % de bônus, por tempo limitado
- Suporte por e-mail prioritário
- Tudo o que qualquer conta recebe
Scale
Limitado · +$250Tráfego em produção
- $1.250 de crédito ao recarregar $1.000
- 25 % de bônus, por tempo limitado
- Suporte por e-mail prioritário
- Tudo o que qualquer conta recebe
Enterprise
Limitado · +$2000Grande escala
- $7.000 de crédito ao recarregar $5.000
- 40 % de bônus, por tempo limitado
- Suporte por e-mail prioritário
- Tudo o que qualquer conta recebe
Incluído em toda conta
- Chaves de API ilimitadas
- Limite de gasto mensal por chave
- Allowlist de IP por chave
- Auto-recarga com cartão salvo — qualquer valor a partir de $10, opt-in
- Webhooks para tarefas de imagem, vídeo e música
- API de uso e exportação CSV
- Endpoints compatíveis com OpenAI e Anthropic Messages
Start with the popular guides.
- Setup
Gemini API key
Get a Gemini key and call it with the OpenAI SDK — or use one Kunavo key for everything.
Read - Setup
Claude API key
Get a Claude key and call Claude via the OpenAI SDK or the native Messages API.
Read - Pricing
Claude API pricing 2026
Per-model rates ~60% under Anthropic, worked cost examples, and prompt-caching savings.
Read - Pricing
Gemini API pricing 2026
Gemini 3.8 / 3.7 Flash and 2.5 rates per 1M tokens, set against Google's intro pricing, with worked examples.
Read - Pricing
GPT API pricing 2026
GPT-5.5, 5.6 Sol, Terra and Luna rates ~60% under OpenAI's list, with worked examples.
Read - Concept
LLM gateway
One API for every model — routing, fallback, billing, observability and security, explained.
Read - API
OpenAI-compatible API
Point any OpenAI SDK at hosted Claude, Gemini and GPT by changing only base_url.
Read - Tools
LLM cost calculator
Estimate per-request and monthly API cost for Claude, Gemini and GPT — with savings vs list.
Read - Video
Text-to-video API
Generate video from a prompt on an OpenAI-style endpoint — live today on Google Veo 3.1.
Read - Video
Veo 3.1 API
Google Veo 3.1 text-to-video with native audio, ~50–70% under Google's list.
Read - Audio
Suno API
Generate full songs from a prompt via /v1/audio/music — metered per request, no subscription.
Read - Image
Nano Banana API
Google's image models through an OpenAI-compatible endpoint, ~25–50% under Google's list.
Read - Image
GPT-Image-2 API
OpenAI's image model on the OpenAI-compatible images endpoint at about half of list.
Read - Compare
OpenRouter alternative
Kunavo vs OpenRouter — text breadth vs multimodal, pricing, API keys and payments.
Read - Compare
OpenRouter alternatives 2026
Seven honest alternatives by motivation — cheaper, multimodal, BYO-key or open source.
Read - Models
Gemini 3 API
Gemini 3.8 and 3.7 Flash are live — what they cost against Google's introductory rate, and how to call them.
Read - Setup
CC Switch setup
Add Kunavo to CC Switch for Claude Code and Codex — which API format to pick, and why.
Read
Recent deep dives.
- 实战·5 min
在中国稳定调用 Claude / GPT / Gemini — Kunavo 中国友好路由实测
从北京/上海/深圳调用 Kunavo:无需代理即可直连。支付宝/微信支付/双币卡都可用。健壮重试代码 + 何时真的需要代理。
- 教學·6 min
用 Veo 3 為台灣品牌做短影片廣告(Sora 同端點待上線)— 5 分鐘完整教學
從文字 prompt 到 9:16 直式 Reels / TikTok / IG 短影片,全流程教學。圖生影片用既有產品照片動起來。5 種台灣品牌實際應用、繁中文字渲染注意事項、商業可用品質的進階技巧。
- 実装ガイド·8 min
日本語 RAG チャットボットを Claude で構築 — 5,000 文書のナレッジベースを 30 行で
社内ドキュメント 5,000 件を Claude Sonnet 4.6 で検索可能にする RAG 完全実装。1 クエリ約 0.9 円(prompt caching 適用後)。埋め込みは Kunavo では提供しておらず、その工程のみ OpenAI に直接課金されます。日本語特有のトークン消費・ハルシネーション対策・本番投入チェックリスト含む。
Tudo que você
se pergunta.
Não encontrou resposta? Escreva para contact@kunavo.com — respondemos em 24 horas.
O Kunavo foi feito especificamente para devs indies e times pequenos que entregam features de AI em produção. Três diferenças reais: (1) cobrimos texto, imagem, vídeo e música com um único saldo; (2) checkout nativo Stripe, Alipay, Apple Pay, WeChat Pay tudo incluso — sem faturas fora da plataforma; (3) transparência total no routing — nunca trocamos silenciosamente seu modelo por um mais barato.
A maioria dos modelos fica abaixo do preço oficial do provedor — até 70 % mais barato conforme o modelo; alguns ficam no preço de tabela, e a página de cada modelo diz isso. Recargas maiores liberam bônus adicional. Você também economiza operacionalmente: uma conta, um saldo, um SDK, sem mínimo de compromisso. O preço por 1 M de tokens de cada modelo está publicado em /pricing — comparável com o listing upstream a qualquer momento.
Sim. Implementamos o conjunto completo de endpoints da OpenAI: /v1/chat/completions, /v1/embeddings, /v1/images/generations, /v1/models e /v1/video/generations. Streaming, function calling, vision e tool use se comportam identicamente. Projetos que usam o SDK da OpenAI migram trocando base_url — é só isso.
Não. O Kunavo é uma carteira pré-paga. Recargas permanecem na sua conta para sempre — sem assinatura, sem mínimo mensal, sem expiração. Fechamento de conta reembolsa o saldo restante no método de pagamento original.
Nunca. Respostas 4xx e 5xx não são cobradas. Respostas em streaming que desconectam no meio são cobradas apenas pelos tokens efetivamente entregues. Cada cobrança é visível call-by-call no dashboard de uso e exportável em CSV para contabilidade.
Pix (valor exibido em reais, compensação imediata — não exige cartão de crédito internacional), cartões (Visa, Mastercard, Amex, JCB, UnionPay), Apple Pay, Link, Cash App Pay, Klarna, Amazon Pay, Alipay e WeChat Pay. O Stripe converte o preço em USD para reais no checkout, então o Pix aparece com o valor já em BRL. Débito SEPA, BACS e BECS não estão entre os métodos que aceitamos. A auto-recarga é opt-in e funciona só com cartão: salve um cartão uma vez e o saldo se recarrega sozinho no valor que você escolher, a partir de $10.
O Kunavo roda em uma única região US-East (Ashburn, Virgínia) atrás de um edge anycast que termina o TLS perto de você. Contas, cobrança e dados de uso ficam em um único banco de dados primário, com snapshots de volume criptografados diários.
Três minutos até sua primeira chamada.
Uma única API compatível com OpenAI para Claude, Gemini, GPT-Image, Veo e Suno — recarga mínima de $10, você paga só pelo que chamar.