Modelli frontiera,
fino al 70 % sotto il prezzo ufficiale.
I modelli frontiera di OpenAI, Anthropic e Google — Claude, Gemini, GPT-Image, Veo — la maggior parte sotto il prezzo ufficiale del provider, fino al 70 % in meno a seconda del modello, dietro una sola API compatibile con OpenAI. Cambia una riga di base_url e sei in produzione.
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model. base_url: https://api.kunavo.com/v1 auth: Authorization: Bearer $KUNAVO_API_KEY To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt
Provider integrati
Il gateway AI per i dev che spediscono.
Dal livello di routing al registro di fatturazione, ogni strato di Kunavo è pensato per sviluppatori indie e piccoli team che portano funzionalità AI a utenti veri.
Fronte edge, hosting US-East
Una rete edge Anycast termina il TLS vicino a te; il gateway vero e proprio gira in una sola regione US-East (Ashburn, Virginia).
Compatibile con OpenAI
Sostituzione drop-in per l'SDK OpenAI. Streaming, function calling, tool use, vision — tutto compatibile a livello di protocollo. Nessun nuovo client da imparare.
Fatturazione nativa Stripe
Carte, Apple Pay, Link, Alipay, WeChat Pay — i metodi che Stripe offre sui pagamenti in USD. Ricarica self-service, auto-ricarica opzionale, nessun abbonamento.
Modelli frontiera, fino al 70 % in meno
Ogni modello di OpenAI, Anthropic e Google, la maggior parte sotto il prezzo di listino ufficiale — fino al 70 % in meno a seconda del modello. Claude, Gemini, GPT-Image, Veo — testo, immagine, video su un unico saldo.
Prezzi trasparenti
Prezzo per 1M di token pubblicato per ogni modello. Niente moltiplicatori nascosti, niente sorprese, le richieste fallite non vengono addebitate.
Failover automatico
Ogni richiesta può ricadere su un massimo di tre canali upstream. Un canale che sta fallendo viene aggirato prima ancora di inviare la richiesta — nessun retry lato client.
Streaming di prima classe
Implementazione SSE passthrough nativa. Time-to-first-token identico all'upstream — niente buffering, niente batching, nessuna latenza aggiunta.
Utilizzo granulare
Analytics call-by-call per modello, chiave, IP. Webhook alla fine di un task immagine, video o musica. Esporta tutto in CSV quando vuoi.
Prompt caching, fino al 90 % in meno
Le letture di cache di Claude, GPT e Gemini sono fatturate al 10 % della tariffa di input — passa cache_control nel tuo system prompt e i contesti lunghi diventano riletture quasi gratuite. Hit rate e risparmio in tempo reale nel dashboard.
What to build with Kunavo.
- Customer Support
AI customer support
The fastest-ROI AI deployment in any B2C SaaS — automate ticket triage, draft 80% of responses, and escalate the rest cleanly. Production code, real cost numbers, and the compliance pitfalls that catch teams off-guard.
Explore - Knowledge Base
RAG chatbot API
Most internal knowledge bases are dead documentation — nobody finds anything. A Claude-backed RAG chatbot turns them into a real assistant that cites sources and refuses when it doesn't know. Here's the production pattern.
Explore - Trust & Safety
AI content moderation
Modern moderation isn't just regex — it's nuance: sarcasm, dog whistles, brand-context misuse, image+text combinations. LLMs do this far better than rule-based systems, at a price that scales.
Explore - Developer Tools
AI code assistant
Cursor, Aider, Cline, Continue.dev — they're all powered by the same handful of frontier LLMs. If you're building a coding tool (or a co-pilot inside your own dev product), here's the architecture and the cost reality.
Explore - Data Processing
AI data extraction
The boring, valuable use case. Invoices, receipts, contracts, leads, resumes — anywhere you'd previously have built a parser, an LLM with JSON-mode does it in 30 lines, more accurately, and you can ship in a day instead of a quarter.
Explore
Modelli frontiera, fino al 70 % sotto il prezzo ufficiale.
Claude Fable 5
Frontier reasoning and long-horizon agents — the model Fable 5.1 succeeds.
Claude Opus 5
Near-flagship Opus reasoning at half the price of Fable 5 — vision and agentic coding.
Claude Opus 4.8
Anthropic Opus 4.8 — stronger agentic coding and honesty.
Claude Opus 4.7
Anthropic Opus 4.7 — previous-generation Opus; reasoning and vision.
Claude Opus 4.6
Anthropic Opus 4.6 — deep reasoning, exceptional agentic ability.
Claude Sonnet 5
Near-Opus coding and agentic quality at Sonnet cost.
Claude Sonnet 4.6
Balanced speed/quality — the everyday production workhorse, elite coding.
Claude Haiku 4.5
Anthropic Haiku 4.5 — fast and cost-efficient.
Gemini 3.8 Flash
Google's newest Flash — long-horizon software engineering and agentic execution.
Gemini 3.7 Flash
Google's newest Flash — stronger coding and agentic execution at half the 3.6 official rate.
Gemini 3.6 Flash
Gemini 3.6 Flash — thinking-by-default at Flash latency, with native audio input.
Gemini 3.1 Pro
Gemini 3.1 Pro — Google's flagship for coding, agents, and cross-modal analysis.
Gemini 2.5 Flash
Previous-gen Gemini Flash — extreme value.
GPT-6 Astra
OpenAI's newest flagship — frontier reasoning and long-horizon agentic coding.
GPT-5.6 Sol
OpenAI's newest flagship — top-tier reasoning and agentic coding.
GPT-5.6 Terra
GPT-5.6 mid tier — the everyday workhorse of the 5.6 family.
GPT-5.6 Luna
GPT-5.6 fast tier — high-volume, low-latency execution at mini-class cost.
GPT-5.5
OpenAI GPT-5.5 — flagship reasoning and agentic tool use.
Punta il tuo agent a llms.txt
e funziona da solo.
Dai a Claude Code, Cursor, Cline — o a qualsiasi agent compatibile con OpenAI — una sola istruzione. Carica il catalogo modelli live di Kunavo e gestisce modelli di testo, immagine e video in autonomia. Nessun SDK, nessun glue code.
- Compatibile con il protocollo OpenAI — gli agent non hanno bisogno di integrazione custom
- GET /v1/models è il catalogo live — non hardcodare mai i nomi dei modelli
- Una chiave, tutte le modalità: testo, immagine, video, audio
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model. base_url: https://api.kunavo.com/v1 auth: Authorization: Bearer $KUNAVO_API_KEY To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt
Più ricarichi in anticipo, più risparmi.
Wallet prepagato. Da $10. Senza abbonamento, senza minimo, il credito non scade mai.
Starter
Primi test
- Accesso a tutti i modelli e agli endpoint
- Analytics call-by-call
- Supporto email
- Nessun abbonamento, nessuna scadenza — da $10
Builder
Limitato · +$10Stai costruendo un prodotto
- $110 di credito con $100 ricaricati
- 10 % di bonus, a tempo limitato
- Supporto email prioritario
- Tutto quello che ha ogni account
Scale
Limitato · +$250Traffico in produzione
- $1.250 di credito con $1.000 ricaricati
- 25 % di bonus, a tempo limitato
- Supporto email prioritario
- Tutto quello che ha ogni account
Enterprise
Limitato · +$2000Grande scala
- $7.000 di credito con $5.000 ricaricati
- 40 % di bonus, a tempo limitato
- Supporto email prioritario
- Tutto quello che ha ogni account
Incluso in ogni account
- Chiavi API illimitate
- Limite di spesa mensile per chiave
- IP allowlist per chiave
- Auto-ricarica da una carta salvata — qualsiasi importo da $10, opt-in
- Webhook per i task immagine, video e musica
- API di utilizzo ed export CSV
- Endpoint compatibili OpenAI e Anthropic Messages
Start with the popular guides.
- Setup
Gemini API key
Get a Gemini key and call it with the OpenAI SDK — or use one Kunavo key for everything.
Read - Setup
Claude API key
Get a Claude key and call Claude via the OpenAI SDK or the native Messages API.
Read - Pricing
Claude API pricing 2026
Per-model rates ~60% under Anthropic, worked cost examples, and prompt-caching savings.
Read - Pricing
Gemini API pricing 2026
Gemini 3.8 / 3.7 Flash and 2.5 rates per 1M tokens, set against Google's intro pricing, with worked examples.
Read - Pricing
GPT API pricing 2026
GPT-5.5, 5.6 Sol, Terra and Luna rates ~60% under OpenAI's list, with worked examples.
Read - Concept
LLM gateway
One API for every model — routing, fallback, billing, observability and security, explained.
Read - API
OpenAI-compatible API
Point any OpenAI SDK at hosted Claude, Gemini and GPT by changing only base_url.
Read - Tools
LLM cost calculator
Estimate per-request and monthly API cost for Claude, Gemini and GPT — with savings vs list.
Read - Video
Text-to-video API
Generate video from a prompt on an OpenAI-style endpoint — live today on Google Veo 3.1.
Read - Video
Veo 3.1 API
Google Veo 3.1 text-to-video with native audio, ~50–70% under Google's list.
Read - Audio
Suno API
Generate full songs from a prompt via /v1/audio/music — metered per request, no subscription.
Read - Image
Nano Banana API
Google's image models through an OpenAI-compatible endpoint, ~25–50% under Google's list.
Read - Image
GPT-Image-2 API
OpenAI's image model on the OpenAI-compatible images endpoint at about half of list.
Read - Compare
OpenRouter alternative
Kunavo vs OpenRouter — text breadth vs multimodal, pricing, API keys and payments.
Read - Compare
OpenRouter alternatives 2026
Seven honest alternatives by motivation — cheaper, multimodal, BYO-key or open source.
Read - Models
Gemini 3 API
Gemini 3.8 and 3.7 Flash are live — what they cost against Google's introductory rate, and how to call them.
Read - Setup
CC Switch setup
Add Kunavo to CC Switch for Claude Code and Codex — which API format to pick, and why.
Read
Recent deep dives.
- 实战·5 min
在中国稳定调用 Claude / GPT / Gemini — Kunavo 中国友好路由实测
从北京/上海/深圳调用 Kunavo:无需代理即可直连。支付宝/微信支付/双币卡都可用。健壮重试代码 + 何时真的需要代理。
- 教學·6 min
用 Veo 3 為台灣品牌做短影片廣告(Sora 同端點待上線)— 5 分鐘完整教學
從文字 prompt 到 9:16 直式 Reels / TikTok / IG 短影片,全流程教學。圖生影片用既有產品照片動起來。5 種台灣品牌實際應用、繁中文字渲染注意事項、商業可用品質的進階技巧。
- 実装ガイド·8 min
日本語 RAG チャットボットを Claude で構築 — 5,000 文書のナレッジベースを 30 行で
社内ドキュメント 5,000 件を Claude Sonnet 4.6 で検索可能にする RAG 完全実装。1 クエリ約 0.9 円(prompt caching 適用後)。埋め込みは Kunavo では提供しておらず、その工程のみ OpenAI に直接課金されます。日本語特有のトークン消費・ハルシネーション対策・本番投入チェックリスト含む。
Tutto quello
che ti chiedi.
Non hai trovato la risposta? Scrivi a contact@kunavo.com — rispondiamo entro 24 ore.
Kunavo è costruito specificamente per sviluppatori indie e piccoli team che spediscono feature AI in produzione. Tre differenze reali: (1) copriamo testo, immagine, video e musica con un solo saldo; (2) checkout nativo Stripe, Alipay, Apple Pay, WeChat Pay tutto incluso — nessuna fattura fuori piattaforma; (3) totale trasparenza nel routing — non sostituiamo mai silenziosamente il tuo modello con uno più economico.
La maggior parte dei modelli sta sotto il prezzo di listino ufficiale del provider — fino al 70 % in meno a seconda del modello; alcuni sono esattamente a listino, e la pagina del modello lo dice. Le ricariche grandi sbloccano un bonus aggiuntivo. Risparmi anche operativamente: un account, un saldo, un SDK, nessun minimo di impegno. Il prezzo per 1M di token di ogni modello è pubblicato su /pricing — confrontabile con il listing upstream in qualsiasi momento.
Sì. Implementiamo l'intero set di endpoint OpenAI: /v1/chat/completions, /v1/embeddings, /v1/images/generations, /v1/models e /v1/video/generations. Streaming, function calling, vision e tool use si comportano in modo identico. I progetti che usano l'SDK OpenAI migrano cambiando base_url — fine.
No. Kunavo è un wallet prepagato. Le ricariche restano sul tuo account per sempre — niente abbonamenti, niente minimi mensili, niente scadenza. La chiusura dell'account rimborsa il saldo residuo sul metodo di pagamento originale.
Mai. Le risposte 4xx e 5xx non vengono fatturate. Le risposte in streaming che si scollegano a metà vengono addebitate solo per i token effettivamente consegnati. Ogni addebito è visibile call-by-call nel dashboard di utilizzo, esportabile in CSV per la contabilità.
Carte (Visa, Mastercard, Amex, JCB, UnionPay), Apple Pay, Link, Cash App Pay, Klarna, Amazon Pay, Alipay e WeChat Pay. I metodi locali seguono il paese di chi paga — Pix in Brasile, Bancontact in Belgio, BLIK in Polonia, EPS in Austria, MB WAY in Portogallo — con Stripe che converte il prezzo in USD nella valuta locale al checkout. Addebito SEPA, BACS e BECS non rientrano tra i metodi che accettiamo; una carta emessa in quei paesi funziona normalmente. L'auto-ricarica è opt-in e solo con carta: salva una carta una volta e il saldo si ricarica da solo dell'importo che scegli, da $10.
Kunavo gira in una sola regione US-East (Ashburn, Virginia) dietro un edge anycast che termina il TLS vicino a te. Account, fatturazione e dati di utilizzo stanno in un unico database primario, con snapshot di volume cifrati giornalieri.
Tre minuti alla tua prima chiamata.
Un'unica API compatibile con OpenAI per Claude, Gemini, GPT-Image, Veo e Suno — ricarica minima di $10, paghi solo per ciò che chiami.