Modelos de frontera,
hasta un 70 % menos que el precio oficial.
Los modelos de frontera de OpenAI, Anthropic y Google — Claude, Gemini, GPT-Image, Veo — la mayoría por debajo del precio oficial del proveedor, hasta un 70 % menos según el modelo, tras una API compatible con OpenAI. Cambia una línea de base_url y estás en producción.
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model. base_url: https://api.kunavo.com/v1 auth: Authorization: Bearer $KUNAVO_API_KEY To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt
Proveedores integrados
El gateway de AI para devs que envían a producción.
Desde la capa de routing hasta el libro mayor de facturación, cada capa de Kunavo está diseñada para devs independientes y equipos pequeños que entregan funciones de AI a usuarios reales.
Frente edge, alojamiento US-East
Una red edge Anycast termina el TLS cerca de ti; la pasarela en sí corre en una única región US-East (Ashburn, Virginia).
Compatible con OpenAI
Reemplazo drop-in para el SDK de OpenAI. Streaming, function calling, tool use, vision — todo compatible a nivel de protocolo. Sin nuevo cliente que aprender.
Facturación nativa Stripe
Tarjetas, Apple Pay, Link, Alipay, WeChat Pay — los métodos que Stripe ofrece para cobros en USD. Recarga self-service, auto-recarga opcional, sin suscripción.
Modelos de frontera, hasta un 70 % más baratos
Cada modelo de OpenAI, Anthropic y Google, la mayoría por debajo del precio oficial del proveedor — hasta un 70 % menos según el modelo. Claude, Gemini, GPT-Image, Veo — texto, imagen y video con un solo saldo.
Precios transparentes
Tarifas por millón de tokens publicadas para cada modelo. Sin multiplicadores ocultos, sin sorpresas, las requests fallidas no se facturan.
Failover automático
Cada request puede caer en cascada por hasta tres canales upstream. Un canal que viene fallando se evita antes de enviar tu request — sin reintentos en el cliente.
Streaming de primera clase
Implementación nativa SSE passthrough. Time-to-first-token idéntico al upstream — sin buffering, sin batching, sin latencia añadida.
Uso granular
Analytics call-by-call por modelo, por clave, por IP. Webhooks al terminar una tarea de imagen, video o música. Exporta todo a CSV cuando quieras.
Prompt caching, hasta 90 % más barato
Las lecturas de caché de Claude, GPT y Gemini se facturan al 10 % del precio de input — pasa cache_control en tu system prompt y los contextos largos se vuelven re-lecturas casi gratuitas. Hit rate y ahorro en tiempo real en el dashboard.
What to build with Kunavo.
- Customer Support
AI customer support
The fastest-ROI AI deployment in any B2C SaaS — automate ticket triage, draft 80% of responses, and escalate the rest cleanly. Production code, real cost numbers, and the compliance pitfalls that catch teams off-guard.
Explore - Knowledge Base
RAG chatbot API
Most internal knowledge bases are dead documentation — nobody finds anything. A Claude-backed RAG chatbot turns them into a real assistant that cites sources and refuses when it doesn't know. Here's the production pattern.
Explore - Trust & Safety
AI content moderation
Modern moderation isn't just regex — it's nuance: sarcasm, dog whistles, brand-context misuse, image+text combinations. LLMs do this far better than rule-based systems, at a price that scales.
Explore - Developer Tools
AI code assistant
Cursor, Aider, Cline, Continue.dev — they're all powered by the same handful of frontier LLMs. If you're building a coding tool (or a co-pilot inside your own dev product), here's the architecture and the cost reality.
Explore - Data Processing
AI data extraction
The boring, valuable use case. Invoices, receipts, contracts, leads, resumes — anywhere you'd previously have built a parser, an LLM with JSON-mode does it in 30 lines, more accurately, and you can ship in a day instead of a quarter.
Explore
Modelos de frontera, hasta un 70 % bajo precio oficial.
Claude Fable 5
Frontier reasoning and long-horizon agents — the model Fable 5.1 succeeds.
Claude Opus 5
Near-flagship Opus reasoning at half the price of Fable 5 — vision and agentic coding.
Claude Opus 4.8
Anthropic Opus 4.8 — stronger agentic coding and honesty.
Claude Opus 4.7
Anthropic Opus 4.7 — previous-generation Opus; reasoning and vision.
Claude Opus 4.6
Anthropic Opus 4.6 — deep reasoning, exceptional agentic ability.
Claude Sonnet 5
Near-Opus coding and agentic quality at Sonnet cost.
Claude Sonnet 4.6
Balanced speed/quality — the everyday production workhorse, elite coding.
Claude Haiku 4.5
Anthropic Haiku 4.5 — fast and cost-efficient.
Gemini 3.8 Flash
Google's newest Flash — long-horizon software engineering and agentic execution.
Gemini 3.7 Flash
Google's newest Flash — stronger coding and agentic execution at half the 3.6 official rate.
Gemini 3.6 Flash
Gemini 3.6 Flash — thinking-by-default at Flash latency, with native audio input.
Gemini 3.1 Pro
Gemini 3.1 Pro — Google's flagship for coding, agents, and cross-modal analysis.
Gemini 2.5 Flash
Previous-gen Gemini Flash — extreme value.
GPT-6 Astra
OpenAI's newest flagship — frontier reasoning and long-horizon agentic coding.
GPT-5.6 Sol
OpenAI's newest flagship — top-tier reasoning and agentic coding.
GPT-5.6 Terra
GPT-5.6 mid tier — the everyday workhorse of the 5.6 family.
GPT-5.6 Luna
GPT-5.6 fast tier — high-volume, low-latency execution at mini-class cost.
GPT-5.5
OpenAI GPT-5.5 — flagship reasoning and agentic tool use.
Apunta tu agente a llms.txt
y se autoejecuta.
Dale a Claude Code, Cursor, Cline — o a cualquier agente compatible con OpenAI — una sola instrucción. Cargará el catálogo de modelos en vivo de Kunavo y operará modelos de texto, imagen y video de forma autónoma. Sin SDK, sin glue code.
- Compatible con el protocolo OpenAI — los agentes no necesitan integración personalizada
- GET /v1/models es el catálogo en vivo — nunca hagas hardcode de nombres de modelos
- Una clave, todas las modalidades: texto, imagen, video, audio
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model. base_url: https://api.kunavo.com/v1 auth: Authorization: Bearer $KUNAVO_API_KEY To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt
Cuanto más recargas por adelantado, más ahorras.
Cartera prepago. Desde $10. Sin suscripciones, sin mínimos, el saldo no caduca.
Starter
Primeras pruebas
- Acceso a todos los modelos y endpoints
- Analytics call-by-call
- Soporte por email
- Sin suscripción, sin caducidad — desde $10
Builder
Limitado · +$10Estás construyendo un producto
- $110 de crédito por $100 recargados
- 10 % de bono, por tiempo limitado
- Soporte email prioritario
- Todo lo que recibe cualquier cuenta
Scale
Limitado · +$250Tráfico en producción
- $1.250 de crédito por $1.000 recargados
- 25 % de bono, por tiempo limitado
- Soporte email prioritario
- Todo lo que recibe cualquier cuenta
Enterprise
Limitado · +$2000Gran escala
- $7.000 de crédito por $5.000 recargados
- 40 % de bono, por tiempo limitado
- Soporte email prioritario
- Todo lo que recibe cualquier cuenta
Incluido en cada cuenta
- API keys ilimitadas
- Límite de gasto mensual por clave
- Lista de IP permitidas por clave
- Auto-recarga desde una tarjeta guardada — cualquier importe desde $10, opt-in
- Webhooks para tareas de imagen, video y música
- API de uso y exportación CSV
- Endpoints compatibles con OpenAI y Anthropic Messages
Start with the popular guides.
- Setup
Gemini API key
Get a Gemini key and call it with the OpenAI SDK — or use one Kunavo key for everything.
Read - Setup
Claude API key
Get a Claude key and call Claude via the OpenAI SDK or the native Messages API.
Read - Pricing
Claude API pricing 2026
Per-model rates ~60% under Anthropic, worked cost examples, and prompt-caching savings.
Read - Pricing
Gemini API pricing 2026
Gemini 3.8 / 3.7 Flash and 2.5 rates per 1M tokens, set against Google's intro pricing, with worked examples.
Read - Pricing
GPT API pricing 2026
GPT-5.5, 5.6 Sol, Terra and Luna rates ~60% under OpenAI's list, with worked examples.
Read - Concept
LLM gateway
One API for every model — routing, fallback, billing, observability and security, explained.
Read - API
OpenAI-compatible API
Point any OpenAI SDK at hosted Claude, Gemini and GPT by changing only base_url.
Read - Tools
LLM cost calculator
Estimate per-request and monthly API cost for Claude, Gemini and GPT — with savings vs list.
Read - Video
Text-to-video API
Generate video from a prompt on an OpenAI-style endpoint — live today on Google Veo 3.1.
Read - Video
Veo 3.1 API
Google Veo 3.1 text-to-video with native audio, ~50–70% under Google's list.
Read - Audio
Suno API
Generate full songs from a prompt via /v1/audio/music — metered per request, no subscription.
Read - Image
Nano Banana API
Google's image models through an OpenAI-compatible endpoint, ~25–50% under Google's list.
Read - Image
GPT-Image-2 API
OpenAI's image model on the OpenAI-compatible images endpoint at about half of list.
Read - Compare
OpenRouter alternative
Kunavo vs OpenRouter — text breadth vs multimodal, pricing, API keys and payments.
Read - Compare
OpenRouter alternatives 2026
Seven honest alternatives by motivation — cheaper, multimodal, BYO-key or open source.
Read - Models
Gemini 3 API
Gemini 3.8 and 3.7 Flash are live — what they cost against Google's introductory rate, and how to call them.
Read - Setup
CC Switch setup
Add Kunavo to CC Switch for Claude Code and Codex — which API format to pick, and why.
Read
Recent deep dives.
- 实战·5 min
在中国稳定调用 Claude / GPT / Gemini — Kunavo 中国友好路由实测
从北京/上海/深圳调用 Kunavo:无需代理即可直连。支付宝/微信支付/双币卡都可用。健壮重试代码 + 何时真的需要代理。
- 教學·6 min
用 Veo 3 為台灣品牌做短影片廣告(Sora 同端點待上線)— 5 分鐘完整教學
從文字 prompt 到 9:16 直式 Reels / TikTok / IG 短影片,全流程教學。圖生影片用既有產品照片動起來。5 種台灣品牌實際應用、繁中文字渲染注意事項、商業可用品質的進階技巧。
- 実装ガイド·8 min
日本語 RAG チャットボットを Claude で構築 — 5,000 文書のナレッジベースを 30 行で
社内ドキュメント 5,000 件を Claude Sonnet 4.6 で検索可能にする RAG 完全実装。1 クエリ約 0.9 円(prompt caching 適用後)。埋め込みは Kunavo では提供しておらず、その工程のみ OpenAI に直接課金されます。日本語特有のトークン消費・ハルシネーション対策・本番投入チェックリスト含む。
Todo lo que
te preguntas.
¿No encuentras respuesta? Escríbenos a contact@kunavo.com — respondemos en 24 horas.
Kunavo está diseñado específicamente para devs indies y equipos pequeños que envían features AI a producción. Tres diferencias reales: (1) cubrimos texto, imagen, video y música con un solo saldo; (2) checkout nativo Stripe, Alipay, Apple Pay, WeChat Pay todo incluido — sin facturas fuera de plataforma; (3) transparencia total en routing — nunca cambiamos silenciosamente tu modelo por uno más barato.
La mayoría de los modelos están por debajo del precio oficial del proveedor — hasta un 70 % menos según el modelo; unos pocos están al precio de lista, y la página de cada modelo lo indica. Las recargas grandes añaden un bono adicional. También ahorras en operaciones: una cuenta, un saldo, un SDK, sin compromisos mínimos. El precio por millón de tokens de cada modelo está publicado en /pricing — comparable con el listing upstream en cualquier momento.
Sí. Implementamos el conjunto completo de endpoints de OpenAI: /v1/chat/completions, /v1/embeddings, /v1/images/generations, /v1/models y /v1/video/generations. Streaming, function calling, vision y tool use se comportan idénticamente. Los proyectos que usan el SDK de OpenAI migran cambiando base_url — eso es todo.
No. Kunavo es una cartera prepago. Las recargas permanecen en tu cuenta para siempre — sin suscripciones, sin mínimos mensuales, sin caducidad. El cierre de cuenta reembolsa el saldo restante al método de pago original.
Nunca. Las respuestas 4xx y 5xx no se facturan. Las respuestas en streaming que se desconectan a mitad de camino solo se facturan por los tokens efectivamente entregados. Cada cargo es visible call-by-call en el dashboard de uso, exportable a CSV para contabilidad.
Tarjetas (Visa, Mastercard, Amex, JCB, UnionPay), Apple Pay, Link, Cash App Pay, Klarna, Amazon Pay, Alipay y WeChat Pay. Los métodos locales dependen del país del comprador — Pix en Brasil, Bancontact en Bélgica, BLIK en Polonia, EPS en Austria, MB WAY en Portugal — y Stripe convierte el precio en USD a la moneda local en el checkout. El adeudo SEPA, BACS y BECS no están entre los métodos que aceptamos; una tarjeta emitida en esos países funciona con normalidad. La auto-recarga es opt-in y solo con tarjeta: guarda una tarjeta una vez y el saldo se rellena solo con el importe que elijas, desde $10.
Kunavo corre en una única región US-East (Ashburn, Virginia) tras un edge anycast que termina el TLS cerca de ti. Las cuentas, la facturación y los datos de uso viven en una sola base de datos primaria con snapshots de volumen cifrados diarios.
Tres minutos hasta tu primera llamada.
Una sola API compatible con OpenAI para Claude, Gemini, GPT-Image, Veo y Suno — recarga mínima de $10, pagas solo por lo que llamas.