Nouveau — GPT-6 Astra, Gemini 3.8 Flash et Seedance 2.5 disponibles

Modèles frontière,
jusqu’à 70 % sous le tarif officiel.

Les modèles frontière d’OpenAI, Anthropic et Google — Claude, Gemini, GPT-Image, Veo — la plupart sous le tarif officiel du fournisseur, jusqu’à 70 % de moins selon le modèle, derrière une seule API compatible OpenAI. Changez une ligne base_url et vous êtes en production.

Setup en 5 secondes · Pas de carte requise · Pas de minimum
À coller dans votre AI agent
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model.

base_url:  https://api.kunavo.com/v1
auth:      Authorization: Bearer $KUNAVO_API_KEY

To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt

Fournisseurs intégrés

OpenAIAnthropicGoogle
37
Modèles disponibles
jusqu’à 70 %
Sous le tarif officiel
$10
Recharge minimum
Automatique
Bascule multi-fournisseurs
Pourquoi Kunavo

La passerelle AI pour les devs qui livrent.

De la couche de routage au registre de facturation, chaque couche de Kunavo est conçue pour les développeurs indépendants et les petites équipes qui livrent de l'AI à de vrais utilisateurs.

Façade edge, hébergement US-East

Un réseau edge Anycast termine le TLS près de vous ; la passerelle elle-même tourne dans une seule région US-East (Ashburn, Virginie).

Compatible OpenAI

Remplacement drop-in du SDK OpenAI. Streaming, function calling, tool use, vision — tout est compatible au niveau du protocole. Aucun nouveau client à apprendre.

Facturation native Stripe

Cartes, Apple Pay, Link, Alipay, WeChat Pay — les méthodes que Stripe propose sur les paiements en USD. Recharge en self-service, auto-recharge optionnelle, sans abonnement.

Modèles frontière, jusqu’à 70 % moins cher

Chaque modèle d’OpenAI, Anthropic et Google, la plupart sous le tarif officiel du fournisseur — jusqu’à 70 % de moins selon le modèle. Claude, Gemini, GPT-Image, Veo — texte, image, vidéo sur un seul solde.

Tarification transparente

Tarif par million de tokens publié pour chaque modèle. Pas de multiplicateurs cachés, pas de surprises, pas de facturation des requêtes échouées.

Bascule automatique

Chaque requête peut basculer sur jusqu’à trois canaux amont successifs. Un canal qui échoue depuis peu est contourné avant même l’envoi de votre requête — aucun retry côté client.

Streaming de classe mondiale

Implémentation native SSE passthrough. Time-to-first-token identique à l'upstream — pas de buffering, pas de batching, pas de latence.

Utilisation détaillée

Analytics call-by-call par modèle, par clé, par IP. Webhooks à la fin d’une tâche image, vidéo ou musique. Export CSV de tout, à tout moment.

Prompt caching, jusqu'à 90 % moins cher

Les lectures de cache sur Claude, GPT et Gemini sont facturées à 10 % du tarif d'input — passez cache_control dans votre system prompt et les longs contextes deviennent des re-lectures quasi gratuites. Hit rate et économies visibles en direct dans le dashboard.

Catalogue de modèles

Modèles frontière, jusqu’à 70 % sous le tarif officiel.

Voir le catalogue complet
Anthropic

Claude Fable 5

30%+ OFF

Frontier reasoning and long-horizon agents — the model Fable 5.1 succeeds.

visionfunctionstreamingthinking
$7.00/$35.00
$10 / $50per 1M tokens
Anthropic

Claude Opus 5

60%+ OFFnew

Near-flagship Opus reasoning at half the price of Fable 5 — vision and agentic coding.

visionfunctionstreamingthinking
$2.00/$10.00
$5 / $25per 1M tokens
Anthropic

Claude Opus 4.8

50%+ OFF

Anthropic Opus 4.8 — stronger agentic coding and honesty.

visionfunctionstreamingthinking
$2.50/$12.50
$5 / $25per 1M tokens
Anthropic

Claude Opus 4.7

60%+ OFF

Anthropic Opus 4.7 — previous-generation Opus; reasoning and vision.

visionfunctionstreamingthinking
$2.00/$10.00
$5 / $25per 1M tokens
Anthropic

Claude Opus 4.6

60%+ OFF

Anthropic Opus 4.6 — deep reasoning, exceptional agentic ability.

visionfunctionstreamingthinking
$2.00/$10.00
$5 / $25per 1M tokens
Anthropic

Claude Sonnet 5

Near-Opus coding and agentic quality at Sonnet cost.

visionfunctionstreamingthinking
$2.00/$10.00
$2 / $10per 1M tokens
Anthropic

Claude Sonnet 4.6

60%+ OFFhot

Balanced speed/quality — the everyday production workhorse, elite coding.

visionfunctionstreamingthinking
$1.20/$6.00
$3 / $15per 1M tokens
Anthropic

Claude Haiku 4.5

60%+ OFF

Anthropic Haiku 4.5 — fast and cost-efficient.

visionfunctionstreaming
$0.40/$2.00
$1 / $5per 1M tokens
Google

Gemini 3.8 Flash

65%+ OFFnew

Google's newest Flash — long-horizon software engineering and agentic execution.

visionfunctionstreamingthinking
$0.525/$2.625
$1.5 / $7.5per 1M tokens
Google

Gemini 3.7 Flash

65%+ OFFnew

Google's newest Flash — stronger coding and agentic execution at half the 3.6 official rate.

visionfunctionstreamingthinking
$0.525/$2.625
$1.5 / $7.5per 1M tokens
Google

Gemini 3.6 Flash

30%+ OFFnew

Gemini 3.6 Flash — thinking-by-default at Flash latency, with native audio input.

visionfunctionstreamingthinking
$1.05/$5.25
$1.5 / $7.5per 1M tokens
Google

Gemini 3.1 Pro

65%+ OFF

Gemini 3.1 Pro — Google's flagship for coding, agents, and cross-modal analysis.

visionfunctionstreamingthinking
$0.70/$4.20
$2 / $12per 1M tokens
Google

Gemini 2.5 Flash

70%+ OFF

Previous-gen Gemini Flash — extreme value.

visionfunctionstreaminglong-context
$0.09/$0.75
$0.3 / $2.5per 1M tokens
OpenAI

GPT-6 Astra

60%+ OFFnew

OpenAI's newest flagship — frontier reasoning and long-horizon agentic coding.

functionstreamingthinkinglong-context
$4.00/$20.00
$10 / $50per 1M tokens
OpenAI

GPT-5.6 Sol

60%+ OFF

OpenAI's newest flagship — top-tier reasoning and agentic coding.

functionstreamingthinkinglong-context
$2.00/$12.00
$5 / $30per 1M tokens
OpenAI

GPT-5.6 Terra

65%+ OFF

GPT-5.6 mid tier — the everyday workhorse of the 5.6 family.

functionstreamingthinkinglong-context
$0.70/$4.20
$2 / $12per 1M tokens
OpenAI

GPT-5.6 Luna

65%+ OFF

GPT-5.6 fast tier — high-volume, low-latency execution at mini-class cost.

functionstreaminglong-context
$0.07/$0.42
$0.2 / $1.2per 1M tokens
OpenAI

GPT-5.5

60%+ OFF

OpenAI GPT-5.5 — flagship reasoning and agentic tool use.

functionstreamingthinkinglong-context
$2.00/$12.00
$5 / $30per 1M tokens
Pour AI agents

Pointez votre agent vers llms.txt
et il roule seul.

Donnez à Claude Code, Cursor, Cline — ou tout agent compatible OpenAI — une seule instruction. Il chargera le catalogue de modèles live de Kunavo et pilotera de manière autonome texte, image et vidéo. Pas besoin de SDK ni de glue code.

  • Compatible avec le protocole OpenAI — aucune intégration custom requise
  • GET /v1/models est le catalogue live — ne jamais hardcoder les noms de modèles
  • Une clé, toutes les modalités : texte, image, vidéo, audio
À coller dans votre AI agent
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model.

base_url:  https://api.kunavo.com/v1
auth:      Authorization: Bearer $KUNAVO_API_KEY

To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt
Rechargez et économisez

Plus vous rechargez à l'avance, plus vous économisez.

Portefeuille prépayé. À partir de $10. Pas d'abonnement, pas de minimum, le solde n'expire jamais.

Starter

Premiers tests

$10
  • Accès à tous les modèles et endpoints
  • Analytics call-by-call
  • Support e-mail
  • Sans abonnement, sans expiration — à partir de $10
Inscription gratuite
Most popular

Builder

Limité · +$10

Vous construisez un produit

$100
  • $110 de crédit pour $100 rechargés
  • 10 % de bonus, durée limitée
  • Support e-mail prioritaire
  • Tout ce que chaque compte obtient
Recharger $100

Scale

Limité · +$250

Trafic en production

$1000
  • $1 250 de crédit pour $1 000 rechargés
  • 25 % de bonus, durée limitée
  • Support e-mail prioritaire
  • Tout ce que chaque compte obtient
Recharger $1000

Enterprise

Limité · +$2000

Grande échelle

$5000
  • $7 000 de crédit pour $5 000 rechargés
  • 40 % de bonus, durée limitée
  • Support e-mail prioritaire
  • Tout ce que chaque compte obtient
Recharger $5000

Inclus dans chaque compte

  • Clés API illimitées
  • Plafond de dépense mensuel par clé
  • Whitelist IP par clé
  • Auto-recharge depuis une carte enregistrée — montant libre à partir de 10 $, opt-in
  • Webhooks pour les tâches image, vidéo et musique
  • API d’usage et export CSV
  • Endpoints compatibles OpenAI et Anthropic Messages
Guides

Start with the popular guides.

Browse all guides
FAQ

Tout ce que vous
vous demandez.

Pas de réponse à votre question ? Écrivez à contact@kunavo.com — nous répondons sous 24 heures.

  • Kunavo est conçu pour les développeurs indépendants et les petites équipes qui expédient des fonctionnalités AI en production. Trois vraies différences : (1) nous couvrons texte, image, vidéo et musique sur un seul solde ; (2) checkout natif Stripe, Alipay, Apple Pay, WeChat Pay tout inclus — aucune facture hors plateforme ; (3) transparence totale du routage — nous ne remplaçons jamais silencieusement votre modèle par un moins cher.

  • La plupart des modèles sont sous le prix catalogue officiel du fournisseur — jusqu’à 70 % de moins selon le modèle ; quelques-uns sont au prix catalogue, et la fiche du modèle le dit. Les recharges importantes débloquent un bonus supplémentaire. Vous économisez aussi en opérations : un compte, un solde, un SDK, pas de minimum d'engagement. Le tarif par million de tokens de chaque modèle est publié sur /pricing — comparable à tout moment au listing upstream.

  • Oui. Nous implémentons l'ensemble complet des endpoints OpenAI : /v1/chat/completions, /v1/embeddings, /v1/images/generations, /v1/models et /v1/video/generations. Streaming, function calling, vision et tool use se comportent à l'identique. Les projets utilisant le SDK OpenAI migrent en changeant base_url — c'est tout.

  • Non. Kunavo est un portefeuille prépayé. Les recharges restent sur votre compte pour toujours — pas d'abonnement, pas de minimum mensuel, pas d'expiration. La fermeture de compte rembourse le solde restant sur le moyen de paiement d'origine.

  • Jamais. Les réponses 4xx et 5xx ne sont pas facturées. Les réponses streamées qui se déconnectent en cours de route ne sont facturées que sur les tokens effectivement livrés. Chaque charge est visible call-by-call dans le dashboard d'utilisation, exportable en CSV pour la comptabilité.

  • Cartes (Visa, Mastercard, Amex, JCB, UnionPay), Apple Pay, Link, Cash App Pay, Klarna, Amazon Pay, Alipay et WeChat Pay. Les moyens locaux suivent le pays de l'acheteur — Pix au Brésil, Bancontact en Belgique, BLIK en Pologne, EPS en Autriche, MB WAY au Portugal —, Stripe convertissant le prix en USD vers la devise locale au checkout. Le prélèvement SEPA, BACS et BECS ne font pas partie des moyens que nous acceptons ; une carte émise dans ces pays fonctionne normalement. L'auto-recharge est optionnelle et fonctionne uniquement par carte : enregistrez une carte une fois, et le solde se recharge seul du montant de votre choix, à partir de 10 $.

  • Kunavo tourne dans une seule région US-East (Ashburn, Virginie) derrière un edge anycast qui termine le TLS près de vous. Les comptes, la facturation et les données d’usage vivent dans une seule base de données primaire, avec des snapshots de volume chiffrés quotidiens.

Trois minutes jusqu'au premier appel.

Une seule API compatible OpenAI pour Claude, Gemini, GPT-Image, Veo et Suno — recharge minimale de $10, vous ne payez que ce que vous appelez.