Modèles frontière,
jusqu’à 70 % sous le tarif officiel.
Les modèles frontière d’OpenAI, Anthropic et Google — Claude, Gemini, GPT-Image, Veo — la plupart sous le tarif officiel du fournisseur, jusqu’à 70 % de moins selon le modèle, derrière une seule API compatible OpenAI. Changez une ligne base_url et vous êtes en production.
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model. base_url: https://api.kunavo.com/v1 auth: Authorization: Bearer $KUNAVO_API_KEY To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt
Fournisseurs intégrés
La passerelle AI pour les devs qui livrent.
De la couche de routage au registre de facturation, chaque couche de Kunavo est conçue pour les développeurs indépendants et les petites équipes qui livrent de l'AI à de vrais utilisateurs.
Façade edge, hébergement US-East
Un réseau edge Anycast termine le TLS près de vous ; la passerelle elle-même tourne dans une seule région US-East (Ashburn, Virginie).
Compatible OpenAI
Remplacement drop-in du SDK OpenAI. Streaming, function calling, tool use, vision — tout est compatible au niveau du protocole. Aucun nouveau client à apprendre.
Facturation native Stripe
Cartes, Apple Pay, Link, Alipay, WeChat Pay — les méthodes que Stripe propose sur les paiements en USD. Recharge en self-service, auto-recharge optionnelle, sans abonnement.
Modèles frontière, jusqu’à 70 % moins cher
Chaque modèle d’OpenAI, Anthropic et Google, la plupart sous le tarif officiel du fournisseur — jusqu’à 70 % de moins selon le modèle. Claude, Gemini, GPT-Image, Veo — texte, image, vidéo sur un seul solde.
Tarification transparente
Tarif par million de tokens publié pour chaque modèle. Pas de multiplicateurs cachés, pas de surprises, pas de facturation des requêtes échouées.
Bascule automatique
Chaque requête peut basculer sur jusqu’à trois canaux amont successifs. Un canal qui échoue depuis peu est contourné avant même l’envoi de votre requête — aucun retry côté client.
Streaming de classe mondiale
Implémentation native SSE passthrough. Time-to-first-token identique à l'upstream — pas de buffering, pas de batching, pas de latence.
Utilisation détaillée
Analytics call-by-call par modèle, par clé, par IP. Webhooks à la fin d’une tâche image, vidéo ou musique. Export CSV de tout, à tout moment.
Prompt caching, jusqu'à 90 % moins cher
Les lectures de cache sur Claude, GPT et Gemini sont facturées à 10 % du tarif d'input — passez cache_control dans votre system prompt et les longs contextes deviennent des re-lectures quasi gratuites. Hit rate et économies visibles en direct dans le dashboard.
What to build with Kunavo.
- Customer Support
AI customer support
The fastest-ROI AI deployment in any B2C SaaS — automate ticket triage, draft 80% of responses, and escalate the rest cleanly. Production code, real cost numbers, and the compliance pitfalls that catch teams off-guard.
Explore - Knowledge Base
RAG chatbot API
Most internal knowledge bases are dead documentation — nobody finds anything. A Claude-backed RAG chatbot turns them into a real assistant that cites sources and refuses when it doesn't know. Here's the production pattern.
Explore - Trust & Safety
AI content moderation
Modern moderation isn't just regex — it's nuance: sarcasm, dog whistles, brand-context misuse, image+text combinations. LLMs do this far better than rule-based systems, at a price that scales.
Explore - Developer Tools
AI code assistant
Cursor, Aider, Cline, Continue.dev — they're all powered by the same handful of frontier LLMs. If you're building a coding tool (or a co-pilot inside your own dev product), here's the architecture and the cost reality.
Explore - Data Processing
AI data extraction
The boring, valuable use case. Invoices, receipts, contracts, leads, resumes — anywhere you'd previously have built a parser, an LLM with JSON-mode does it in 30 lines, more accurately, and you can ship in a day instead of a quarter.
Explore
Modèles frontière, jusqu’à 70 % sous le tarif officiel.
Claude Fable 5
Frontier reasoning and long-horizon agents — the model Fable 5.1 succeeds.
Claude Opus 5
Near-flagship Opus reasoning at half the price of Fable 5 — vision and agentic coding.
Claude Opus 4.8
Anthropic Opus 4.8 — stronger agentic coding and honesty.
Claude Opus 4.7
Anthropic Opus 4.7 — previous-generation Opus; reasoning and vision.
Claude Opus 4.6
Anthropic Opus 4.6 — deep reasoning, exceptional agentic ability.
Claude Sonnet 5
Near-Opus coding and agentic quality at Sonnet cost.
Claude Sonnet 4.6
Balanced speed/quality — the everyday production workhorse, elite coding.
Claude Haiku 4.5
Anthropic Haiku 4.5 — fast and cost-efficient.
Gemini 3.8 Flash
Google's newest Flash — long-horizon software engineering and agentic execution.
Gemini 3.7 Flash
Google's newest Flash — stronger coding and agentic execution at half the 3.6 official rate.
Gemini 3.6 Flash
Gemini 3.6 Flash — thinking-by-default at Flash latency, with native audio input.
Gemini 3.1 Pro
Gemini 3.1 Pro — Google's flagship for coding, agents, and cross-modal analysis.
Gemini 2.5 Flash
Previous-gen Gemini Flash — extreme value.
GPT-6 Astra
OpenAI's newest flagship — frontier reasoning and long-horizon agentic coding.
GPT-5.6 Sol
OpenAI's newest flagship — top-tier reasoning and agentic coding.
GPT-5.6 Terra
GPT-5.6 mid tier — the everyday workhorse of the 5.6 family.
GPT-5.6 Luna
GPT-5.6 fast tier — high-volume, low-latency execution at mini-class cost.
GPT-5.5
OpenAI GPT-5.5 — flagship reasoning and agentic tool use.
Pointez votre agent vers llms.txt
et il roule seul.
Donnez à Claude Code, Cursor, Cline — ou tout agent compatible OpenAI — une seule instruction. Il chargera le catalogue de modèles live de Kunavo et pilotera de manière autonome texte, image et vidéo. Pas besoin de SDK ni de glue code.
- Compatible avec le protocole OpenAI — aucune intégration custom requise
- GET /v1/models est le catalogue live — ne jamais hardcoder les noms de modèles
- Une clé, toutes les modalités : texte, image, vidéo, audio
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model. base_url: https://api.kunavo.com/v1 auth: Authorization: Bearer $KUNAVO_API_KEY To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt
Plus vous rechargez à l'avance, plus vous économisez.
Portefeuille prépayé. À partir de $10. Pas d'abonnement, pas de minimum, le solde n'expire jamais.
Starter
Premiers tests
- Accès à tous les modèles et endpoints
- Analytics call-by-call
- Support e-mail
- Sans abonnement, sans expiration — à partir de $10
Builder
Limité · +$10Vous construisez un produit
- $110 de crédit pour $100 rechargés
- 10 % de bonus, durée limitée
- Support e-mail prioritaire
- Tout ce que chaque compte obtient
Scale
Limité · +$250Trafic en production
- $1 250 de crédit pour $1 000 rechargés
- 25 % de bonus, durée limitée
- Support e-mail prioritaire
- Tout ce que chaque compte obtient
Enterprise
Limité · +$2000Grande échelle
- $7 000 de crédit pour $5 000 rechargés
- 40 % de bonus, durée limitée
- Support e-mail prioritaire
- Tout ce que chaque compte obtient
Inclus dans chaque compte
- Clés API illimitées
- Plafond de dépense mensuel par clé
- Whitelist IP par clé
- Auto-recharge depuis une carte enregistrée — montant libre à partir de 10 $, opt-in
- Webhooks pour les tâches image, vidéo et musique
- API d’usage et export CSV
- Endpoints compatibles OpenAI et Anthropic Messages
Start with the popular guides.
- Setup
Gemini API key
Get a Gemini key and call it with the OpenAI SDK — or use one Kunavo key for everything.
Read - Setup
Claude API key
Get a Claude key and call Claude via the OpenAI SDK or the native Messages API.
Read - Pricing
Claude API pricing 2026
Per-model rates ~60% under Anthropic, worked cost examples, and prompt-caching savings.
Read - Pricing
Gemini API pricing 2026
Gemini 3.8 / 3.7 Flash and 2.5 rates per 1M tokens, set against Google's intro pricing, with worked examples.
Read - Pricing
GPT API pricing 2026
GPT-5.5, 5.6 Sol, Terra and Luna rates ~60% under OpenAI's list, with worked examples.
Read - Concept
LLM gateway
One API for every model — routing, fallback, billing, observability and security, explained.
Read - API
OpenAI-compatible API
Point any OpenAI SDK at hosted Claude, Gemini and GPT by changing only base_url.
Read - Tools
LLM cost calculator
Estimate per-request and monthly API cost for Claude, Gemini and GPT — with savings vs list.
Read - Video
Text-to-video API
Generate video from a prompt on an OpenAI-style endpoint — live today on Google Veo 3.1.
Read - Video
Veo 3.1 API
Google Veo 3.1 text-to-video with native audio, ~50–70% under Google's list.
Read - Audio
Suno API
Generate full songs from a prompt via /v1/audio/music — metered per request, no subscription.
Read - Image
Nano Banana API
Google's image models through an OpenAI-compatible endpoint, ~25–50% under Google's list.
Read - Image
GPT-Image-2 API
OpenAI's image model on the OpenAI-compatible images endpoint at about half of list.
Read - Compare
OpenRouter alternative
Kunavo vs OpenRouter — text breadth vs multimodal, pricing, API keys and payments.
Read - Compare
OpenRouter alternatives 2026
Seven honest alternatives by motivation — cheaper, multimodal, BYO-key or open source.
Read - Models
Gemini 3 API
Gemini 3.8 and 3.7 Flash are live — what they cost against Google's introductory rate, and how to call them.
Read - Setup
CC Switch setup
Add Kunavo to CC Switch for Claude Code and Codex — which API format to pick, and why.
Read
Recent deep dives.
- 实战·5 min
在中国稳定调用 Claude / GPT / Gemini — Kunavo 中国友好路由实测
从北京/上海/深圳调用 Kunavo:无需代理即可直连。支付宝/微信支付/双币卡都可用。健壮重试代码 + 何时真的需要代理。
- 教學·6 min
用 Veo 3 為台灣品牌做短影片廣告(Sora 同端點待上線)— 5 分鐘完整教學
從文字 prompt 到 9:16 直式 Reels / TikTok / IG 短影片,全流程教學。圖生影片用既有產品照片動起來。5 種台灣品牌實際應用、繁中文字渲染注意事項、商業可用品質的進階技巧。
- 実装ガイド·8 min
日本語 RAG チャットボットを Claude で構築 — 5,000 文書のナレッジベースを 30 行で
社内ドキュメント 5,000 件を Claude Sonnet 4.6 で検索可能にする RAG 完全実装。1 クエリ約 0.9 円(prompt caching 適用後)。埋め込みは Kunavo では提供しておらず、その工程のみ OpenAI に直接課金されます。日本語特有のトークン消費・ハルシネーション対策・本番投入チェックリスト含む。
Tout ce que vous
vous demandez.
Pas de réponse à votre question ? Écrivez à contact@kunavo.com — nous répondons sous 24 heures.
Kunavo est conçu pour les développeurs indépendants et les petites équipes qui expédient des fonctionnalités AI en production. Trois vraies différences : (1) nous couvrons texte, image, vidéo et musique sur un seul solde ; (2) checkout natif Stripe, Alipay, Apple Pay, WeChat Pay tout inclus — aucune facture hors plateforme ; (3) transparence totale du routage — nous ne remplaçons jamais silencieusement votre modèle par un moins cher.
La plupart des modèles sont sous le prix catalogue officiel du fournisseur — jusqu’à 70 % de moins selon le modèle ; quelques-uns sont au prix catalogue, et la fiche du modèle le dit. Les recharges importantes débloquent un bonus supplémentaire. Vous économisez aussi en opérations : un compte, un solde, un SDK, pas de minimum d'engagement. Le tarif par million de tokens de chaque modèle est publié sur /pricing — comparable à tout moment au listing upstream.
Oui. Nous implémentons l'ensemble complet des endpoints OpenAI : /v1/chat/completions, /v1/embeddings, /v1/images/generations, /v1/models et /v1/video/generations. Streaming, function calling, vision et tool use se comportent à l'identique. Les projets utilisant le SDK OpenAI migrent en changeant base_url — c'est tout.
Non. Kunavo est un portefeuille prépayé. Les recharges restent sur votre compte pour toujours — pas d'abonnement, pas de minimum mensuel, pas d'expiration. La fermeture de compte rembourse le solde restant sur le moyen de paiement d'origine.
Jamais. Les réponses 4xx et 5xx ne sont pas facturées. Les réponses streamées qui se déconnectent en cours de route ne sont facturées que sur les tokens effectivement livrés. Chaque charge est visible call-by-call dans le dashboard d'utilisation, exportable en CSV pour la comptabilité.
Cartes (Visa, Mastercard, Amex, JCB, UnionPay), Apple Pay, Link, Cash App Pay, Klarna, Amazon Pay, Alipay et WeChat Pay. Les moyens locaux suivent le pays de l'acheteur — Pix au Brésil, Bancontact en Belgique, BLIK en Pologne, EPS en Autriche, MB WAY au Portugal —, Stripe convertissant le prix en USD vers la devise locale au checkout. Le prélèvement SEPA, BACS et BECS ne font pas partie des moyens que nous acceptons ; une carte émise dans ces pays fonctionne normalement. L'auto-recharge est optionnelle et fonctionne uniquement par carte : enregistrez une carte une fois, et le solde se recharge seul du montant de votre choix, à partir de 10 $.
Kunavo tourne dans une seule région US-East (Ashburn, Virginie) derrière un edge anycast qui termine le TLS près de vous. Les comptes, la facturation et les données d’usage vivent dans une seule base de données primaire, avec des snapshots de volume chiffrés quotidiens.
Trois minutes jusqu'au premier appel.
Une seule API compatible OpenAI pour Claude, Gemini, GPT-Image, Veo et Suno — recharge minimale de $10, vous ne payez que ce que vous appelez.