Novità — GPT-6 Astra, Gemini 3.8 Flash e Seedance 2.5 ora live

Modelli frontiera,
fino al 70 % sotto il prezzo ufficiale.

I modelli frontiera di OpenAI, Anthropic e Google — Claude, Gemini, GPT-Image, Veo — la maggior parte sotto il prezzo ufficiale del provider, fino al 70 % in meno a seconda del modello, dietro una sola API compatibile con OpenAI. Cambia una riga di base_url e sei in produzione.

Setup in 5 secondi · Senza carta · Senza minimo
Incolla nel tuo AI agent
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model.

base_url:  https://api.kunavo.com/v1
auth:      Authorization: Bearer $KUNAVO_API_KEY

To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt

Provider integrati

OpenAIAnthropicGoogle
37
Modelli disponibili
fino al 70 %
Sotto il prezzo ufficiale
$10
Ricarica minima
Automatico
Failover multi-provider
Perché Kunavo

Il gateway AI per i dev che spediscono.

Dal livello di routing al registro di fatturazione, ogni strato di Kunavo è pensato per sviluppatori indie e piccoli team che portano funzionalità AI a utenti veri.

Fronte edge, hosting US-East

Una rete edge Anycast termina il TLS vicino a te; il gateway vero e proprio gira in una sola regione US-East (Ashburn, Virginia).

Compatibile con OpenAI

Sostituzione drop-in per l'SDK OpenAI. Streaming, function calling, tool use, vision — tutto compatibile a livello di protocollo. Nessun nuovo client da imparare.

Fatturazione nativa Stripe

Carte, Apple Pay, Link, Alipay, WeChat Pay — i metodi che Stripe offre sui pagamenti in USD. Ricarica self-service, auto-ricarica opzionale, nessun abbonamento.

Modelli frontiera, fino al 70 % in meno

Ogni modello di OpenAI, Anthropic e Google, la maggior parte sotto il prezzo di listino ufficiale — fino al 70 % in meno a seconda del modello. Claude, Gemini, GPT-Image, Veo — testo, immagine, video su un unico saldo.

Prezzi trasparenti

Prezzo per 1M di token pubblicato per ogni modello. Niente moltiplicatori nascosti, niente sorprese, le richieste fallite non vengono addebitate.

Failover automatico

Ogni richiesta può ricadere su un massimo di tre canali upstream. Un canale che sta fallendo viene aggirato prima ancora di inviare la richiesta — nessun retry lato client.

Streaming di prima classe

Implementazione SSE passthrough nativa. Time-to-first-token identico all'upstream — niente buffering, niente batching, nessuna latenza aggiunta.

Utilizzo granulare

Analytics call-by-call per modello, chiave, IP. Webhook alla fine di un task immagine, video o musica. Esporta tutto in CSV quando vuoi.

Prompt caching, fino al 90 % in meno

Le letture di cache di Claude, GPT e Gemini sono fatturate al 10 % della tariffa di input — passa cache_control nel tuo system prompt e i contesti lunghi diventano riletture quasi gratuite. Hit rate e risparmio in tempo reale nel dashboard.

Catalogo modelli

Modelli frontiera, fino al 70 % sotto il prezzo ufficiale.

Vedi il catalogo completo
Anthropic

Claude Fable 5

30%+ OFF

Frontier reasoning and long-horizon agents — the model Fable 5.1 succeeds.

visionfunctionstreamingthinking
$7.00/$35.00
$10 / $50per 1M tokens
Anthropic

Claude Opus 5

60%+ OFFnew

Near-flagship Opus reasoning at half the price of Fable 5 — vision and agentic coding.

visionfunctionstreamingthinking
$2.00/$10.00
$5 / $25per 1M tokens
Anthropic

Claude Opus 4.8

50%+ OFF

Anthropic Opus 4.8 — stronger agentic coding and honesty.

visionfunctionstreamingthinking
$2.50/$12.50
$5 / $25per 1M tokens
Anthropic

Claude Opus 4.7

60%+ OFF

Anthropic Opus 4.7 — previous-generation Opus; reasoning and vision.

visionfunctionstreamingthinking
$2.00/$10.00
$5 / $25per 1M tokens
Anthropic

Claude Opus 4.6

60%+ OFF

Anthropic Opus 4.6 — deep reasoning, exceptional agentic ability.

visionfunctionstreamingthinking
$2.00/$10.00
$5 / $25per 1M tokens
Anthropic

Claude Sonnet 5

Near-Opus coding and agentic quality at Sonnet cost.

visionfunctionstreamingthinking
$2.00/$10.00
$2 / $10per 1M tokens
Anthropic

Claude Sonnet 4.6

60%+ OFFhot

Balanced speed/quality — the everyday production workhorse, elite coding.

visionfunctionstreamingthinking
$1.20/$6.00
$3 / $15per 1M tokens
Anthropic

Claude Haiku 4.5

60%+ OFF

Anthropic Haiku 4.5 — fast and cost-efficient.

visionfunctionstreaming
$0.40/$2.00
$1 / $5per 1M tokens
Google

Gemini 3.8 Flash

65%+ OFFnew

Google's newest Flash — long-horizon software engineering and agentic execution.

visionfunctionstreamingthinking
$0.525/$2.625
$1.5 / $7.5per 1M tokens
Google

Gemini 3.7 Flash

65%+ OFFnew

Google's newest Flash — stronger coding and agentic execution at half the 3.6 official rate.

visionfunctionstreamingthinking
$0.525/$2.625
$1.5 / $7.5per 1M tokens
Google

Gemini 3.6 Flash

30%+ OFFnew

Gemini 3.6 Flash — thinking-by-default at Flash latency, with native audio input.

visionfunctionstreamingthinking
$1.05/$5.25
$1.5 / $7.5per 1M tokens
Google

Gemini 3.1 Pro

65%+ OFF

Gemini 3.1 Pro — Google's flagship for coding, agents, and cross-modal analysis.

visionfunctionstreamingthinking
$0.70/$4.20
$2 / $12per 1M tokens
Google

Gemini 2.5 Flash

70%+ OFF

Previous-gen Gemini Flash — extreme value.

visionfunctionstreaminglong-context
$0.09/$0.75
$0.3 / $2.5per 1M tokens
OpenAI

GPT-6 Astra

60%+ OFFnew

OpenAI's newest flagship — frontier reasoning and long-horizon agentic coding.

functionstreamingthinkinglong-context
$4.00/$20.00
$10 / $50per 1M tokens
OpenAI

GPT-5.6 Sol

60%+ OFF

OpenAI's newest flagship — top-tier reasoning and agentic coding.

functionstreamingthinkinglong-context
$2.00/$12.00
$5 / $30per 1M tokens
OpenAI

GPT-5.6 Terra

65%+ OFF

GPT-5.6 mid tier — the everyday workhorse of the 5.6 family.

functionstreamingthinkinglong-context
$0.70/$4.20
$2 / $12per 1M tokens
OpenAI

GPT-5.6 Luna

65%+ OFF

GPT-5.6 fast tier — high-volume, low-latency execution at mini-class cost.

functionstreaminglong-context
$0.07/$0.42
$0.2 / $1.2per 1M tokens
OpenAI

GPT-5.5

60%+ OFF

OpenAI GPT-5.5 — flagship reasoning and agentic tool use.

functionstreamingthinkinglong-context
$2.00/$12.00
$5 / $30per 1M tokens
Per AI agent

Punta il tuo agent a llms.txt
e funziona da solo.

Dai a Claude Code, Cursor, Cline — o a qualsiasi agent compatibile con OpenAI — una sola istruzione. Carica il catalogo modelli live di Kunavo e gestisce modelli di testo, immagine e video in autonomia. Nessun SDK, nessun glue code.

  • Compatibile con il protocollo OpenAI — gli agent non hanno bisogno di integrazione custom
  • GET /v1/models è il catalogo live — non hardcodare mai i nomi dei modelli
  • Una chiave, tutte le modalità: testo, immagine, video, audio
Incolla nel tuo AI agent
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model.

base_url:  https://api.kunavo.com/v1
auth:      Authorization: Bearer $KUNAVO_API_KEY

To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt
Ricarica e risparmia

Più ricarichi in anticipo, più risparmi.

Wallet prepagato. Da $10. Senza abbonamento, senza minimo, il credito non scade mai.

Starter

Primi test

$10
  • Accesso a tutti i modelli e agli endpoint
  • Analytics call-by-call
  • Supporto email
  • Nessun abbonamento, nessuna scadenza — da $10
Registrati gratis
Most popular

Builder

Limitato · +$10

Stai costruendo un prodotto

$100
  • $110 di credito con $100 ricaricati
  • 10 % di bonus, a tempo limitato
  • Supporto email prioritario
  • Tutto quello che ha ogni account
Ricarica $100

Scale

Limitato · +$250

Traffico in produzione

$1000
  • $1.250 di credito con $1.000 ricaricati
  • 25 % di bonus, a tempo limitato
  • Supporto email prioritario
  • Tutto quello che ha ogni account
Ricarica $1000

Enterprise

Limitato · +$2000

Grande scala

$5000
  • $7.000 di credito con $5.000 ricaricati
  • 40 % di bonus, a tempo limitato
  • Supporto email prioritario
  • Tutto quello che ha ogni account
Ricarica $5000

Incluso in ogni account

  • Chiavi API illimitate
  • Limite di spesa mensile per chiave
  • IP allowlist per chiave
  • Auto-ricarica da una carta salvata — qualsiasi importo da $10, opt-in
  • Webhook per i task immagine, video e musica
  • API di utilizzo ed export CSV
  • Endpoint compatibili OpenAI e Anthropic Messages
Guides

Start with the popular guides.

Browse all guides
FAQ

Tutto quello
che ti chiedi.

Non hai trovato la risposta? Scrivi a contact@kunavo.com — rispondiamo entro 24 ore.

  • Kunavo è costruito specificamente per sviluppatori indie e piccoli team che spediscono feature AI in produzione. Tre differenze reali: (1) copriamo testo, immagine, video e musica con un solo saldo; (2) checkout nativo Stripe, Alipay, Apple Pay, WeChat Pay tutto incluso — nessuna fattura fuori piattaforma; (3) totale trasparenza nel routing — non sostituiamo mai silenziosamente il tuo modello con uno più economico.

  • La maggior parte dei modelli sta sotto il prezzo di listino ufficiale del provider — fino al 70 % in meno a seconda del modello; alcuni sono esattamente a listino, e la pagina del modello lo dice. Le ricariche grandi sbloccano un bonus aggiuntivo. Risparmi anche operativamente: un account, un saldo, un SDK, nessun minimo di impegno. Il prezzo per 1M di token di ogni modello è pubblicato su /pricing — confrontabile con il listing upstream in qualsiasi momento.

  • Sì. Implementiamo l'intero set di endpoint OpenAI: /v1/chat/completions, /v1/embeddings, /v1/images/generations, /v1/models e /v1/video/generations. Streaming, function calling, vision e tool use si comportano in modo identico. I progetti che usano l'SDK OpenAI migrano cambiando base_url — fine.

  • No. Kunavo è un wallet prepagato. Le ricariche restano sul tuo account per sempre — niente abbonamenti, niente minimi mensili, niente scadenza. La chiusura dell'account rimborsa il saldo residuo sul metodo di pagamento originale.

  • Mai. Le risposte 4xx e 5xx non vengono fatturate. Le risposte in streaming che si scollegano a metà vengono addebitate solo per i token effettivamente consegnati. Ogni addebito è visibile call-by-call nel dashboard di utilizzo, esportabile in CSV per la contabilità.

  • Carte (Visa, Mastercard, Amex, JCB, UnionPay), Apple Pay, Link, Cash App Pay, Klarna, Amazon Pay, Alipay e WeChat Pay. I metodi locali seguono il paese di chi paga — Pix in Brasile, Bancontact in Belgio, BLIK in Polonia, EPS in Austria, MB WAY in Portogallo — con Stripe che converte il prezzo in USD nella valuta locale al checkout. Addebito SEPA, BACS e BECS non rientrano tra i metodi che accettiamo; una carta emessa in quei paesi funziona normalmente. L'auto-ricarica è opt-in e solo con carta: salva una carta una volta e il saldo si ricarica da solo dell'importo che scegli, da $10.

  • Kunavo gira in una sola regione US-East (Ashburn, Virginia) dietro un edge anycast che termina il TLS vicino a te. Account, fatturazione e dati di utilizzo stanno in un unico database primario, con snapshot di volume cifrati giornalieri.

Tre minuti alla tua prima chiamata.

Un'unica API compatibile con OpenAI per Claude, Gemini, GPT-Image, Veo e Suno — ricarica minima di $10, paghi solo per ciò che chiami.