Mô hình tiên phong,
rẻ hơn tới 70% so với giá chính thức.
Các mô hình tiên phong từ OpenAI, Anthropic và Google — Claude, Gemini, GPT-Image, Veo — phần lớn thấp hơn giá chính thức của nhà cung cấp, rẻ hơn tới 70% tùy mô hình, sau một API tương thích với OpenAI. Đổi một dòng base_url và bạn đã lên production.
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model. base_url: https://api.kunavo.com/v1 auth: Authorization: Bearer $KUNAVO_API_KEY To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt
Nhà cung cấp đã tích hợp
Gateway AI cho lập trình viên đưa sản phẩm lên production.
Từ lớp routing đến sổ cái thanh toán, mỗi lớp của Kunavo đều được thiết kế cho lập trình viên độc lập và đội nhỏ đang mang tính năng AI đến người dùng thật.
Tiếp nhận tại edge, đặt tại US-East
Mạng edge Anycast kết thúc TLS gần bạn; bản thân gateway chạy trong một vùng US-East duy nhất (Ashburn, Virginia).
Tương thích với OpenAI
Thay thế drop-in cho SDK OpenAI. Streaming, function calling, tool use, vision — tất cả tương thích ở cấp giao thức. Không cần học client mới.
Thanh toán native Stripe
Thẻ, Apple Pay, Link, Alipay, WeChat Pay — các phương thức Stripe hỗ trợ cho thanh toán USD. Nạp tiền tự phục vụ, tự động nạp tùy chọn, không thuê bao.
Mô hình tiên phong, rẻ hơn tới 70%
Mọi mô hình từ OpenAI, Anthropic và Google, phần lớn dưới giá chính thức của nhà cung cấp — rẻ hơn tới 70% tùy mô hình. Claude, Gemini, GPT-Image, Veo — văn bản, hình ảnh và video trên một số dư chung.
Giá minh bạch
Mức giá trên mỗi triệu token được công bố cho từng mô hình. Không có hệ số nhân ẩn, không bất ngờ, request thất bại không bị tính phí.
Chuyển dự phòng tự động
Mỗi request có thể chuyển tiếp qua tối đa ba kênh upstream. Kênh đang liên tục lỗi sẽ bị bỏ qua trước khi request của bạn được gửi đi — không cần retry phía client.
Streaming hạng nhất
Triển khai SSE passthrough native. Time-to-first-token giống hệt upstream — không buffering, không batching, không thêm độ trễ.
Mức dùng chi tiết
Analytics theo từng lượt gọi cho mỗi mô hình, mỗi key, mỗi IP. Webhook khi một tác vụ ảnh, video hoặc nhạc hoàn tất. Xuất tất cả ra CSV bất cứ khi nào bạn muốn.
Prompt caching, rẻ tới 90%
Đọc cache trên Claude, GPT và Gemini được tính 10% giá input — truyền cache_control trong system prompt của bạn và những ngữ cảnh dài trở thành các lần đọc lại gần như miễn phí. Hit rate và mức tiết kiệm theo thời gian thực trên dashboard.
What to build with Kunavo.
- Customer Support
AI customer support
The fastest-ROI AI deployment in any B2C SaaS — automate ticket triage, draft 80% of responses, and escalate the rest cleanly. Production code, real cost numbers, and the compliance pitfalls that catch teams off-guard.
Explore - Knowledge Base
RAG chatbot API
Most internal knowledge bases are dead documentation — nobody finds anything. A Claude-backed RAG chatbot turns them into a real assistant that cites sources and refuses when it doesn't know. Here's the production pattern.
Explore - Trust & Safety
AI content moderation
Modern moderation isn't just regex — it's nuance: sarcasm, dog whistles, brand-context misuse, image+text combinations. LLMs do this far better than rule-based systems, at a price that scales.
Explore - Developer Tools
AI code assistant
Cursor, Aider, Cline, Continue.dev — they're all powered by the same handful of frontier LLMs. If you're building a coding tool (or a co-pilot inside your own dev product), here's the architecture and the cost reality.
Explore - Data Processing
AI data extraction
The boring, valuable use case. Invoices, receipts, contracts, leads, resumes — anywhere you'd previously have built a parser, an LLM with JSON-mode does it in 30 lines, more accurately, and you can ship in a day instead of a quarter.
Explore
Mô hình tiên phong, thấp hơn giá chính thức tới 70%.
Claude Fable 5
Frontier reasoning and long-horizon agents — the model Fable 5.1 succeeds.
Claude Opus 5
Near-flagship Opus reasoning at half the price of Fable 5 — vision and agentic coding.
Claude Opus 4.8
Anthropic Opus 4.8 — stronger agentic coding and honesty.
Claude Opus 4.7
Anthropic Opus 4.7 — previous-generation Opus; reasoning and vision.
Claude Opus 4.6
Anthropic Opus 4.6 — deep reasoning, exceptional agentic ability.
Claude Sonnet 5
Near-Opus coding and agentic quality at Sonnet cost.
Claude Sonnet 4.6
Balanced speed/quality — the everyday production workhorse, elite coding.
Claude Haiku 4.5
Anthropic Haiku 4.5 — fast and cost-efficient.
Gemini 3.8 Flash
Google's newest Flash — long-horizon software engineering and agentic execution.
Gemini 3.7 Flash
Google's newest Flash — stronger coding and agentic execution at half the 3.6 official rate.
Gemini 3.6 Flash
Gemini 3.6 Flash — thinking-by-default at Flash latency, with native audio input.
Gemini 3.1 Pro
Gemini 3.1 Pro — Google's flagship for coding, agents, and cross-modal analysis.
Gemini 2.5 Flash
Previous-gen Gemini Flash — extreme value.
GPT-6 Astra
OpenAI's newest flagship — frontier reasoning and long-horizon agentic coding.
GPT-5.6 Sol
OpenAI's newest flagship — top-tier reasoning and agentic coding.
GPT-5.6 Terra
GPT-5.6 mid tier — the everyday workhorse of the 5.6 family.
GPT-5.6 Luna
GPT-5.6 fast tier — high-volume, low-latency execution at mini-class cost.
GPT-5.5
OpenAI GPT-5.5 — flagship reasoning and agentic tool use.
Trỏ agent của bạn tới llms.txt
và nó tự chạy.
Hãy đưa cho Claude Code, Cursor, Cline — hay bất kỳ agent nào tương thích OpenAI — một chỉ dẫn duy nhất. Nó sẽ tải danh mục mô hình trực tiếp của Kunavo và vận hành các mô hình văn bản, hình ảnh, video một cách tự chủ. Không SDK, không glue code.
- Tương thích với giao thức OpenAI — agent không cần tích hợp tùy chỉnh
- GET /v1/models là danh mục trực tiếp — đừng bao giờ hardcode tên mô hình
- Một key, mọi phương thức: văn bản, hình ảnh, video, âm thanh
Use Kunavo as your model provider — an OpenAI-compatible gateway to every frontier text, image and video model. base_url: https://api.kunavo.com/v1 auth: Authorization: Bearer $KUNAVO_API_KEY To use a model, call GET /v1/models for the live catalog, then route each model by its kunavo.endpoint field. Full agent reference: https://kunavo.com/llms.txt
Nạp trước càng nhiều, tiết kiệm càng lớn.
Ví trả trước. Từ $10. Không đăng ký định kỳ, không yêu cầu tối thiểu, số dư không hết hạn.
Starter
Thử nghiệm đầu tiên
- Truy cập mọi mô hình và endpoint
- Analytics theo từng lượt gọi
- Hỗ trợ qua email
- Không thuê bao, số dư không hết hạn — nạp từ $10
Builder
Giới hạn · +$10Bạn đang xây dựng một sản phẩm
- $110 tín dụng cho mỗi $100 nạp vào
- Thưởng 10%, trong thời gian có hạn
- Hỗ trợ email ưu tiên
- Toàn bộ những gì mọi tài khoản đều có
Scale
Giới hạn · +$250Lưu lượng production
- $1.250 tín dụng cho mỗi $1.000 nạp vào
- Thưởng 25%, trong thời gian có hạn
- Hỗ trợ email ưu tiên
- Toàn bộ những gì mọi tài khoản đều có
Enterprise
Giới hạn · +$2000Quy mô lớn
- $7.000 tín dụng cho mỗi $5.000 nạp vào
- Thưởng 40%, trong thời gian có hạn
- Hỗ trợ email ưu tiên
- Toàn bộ những gì mọi tài khoản đều có
Có sẵn trong mọi tài khoản
- API key không giới hạn
- Hạn mức chi tiêu hàng tháng theo từng key
- Danh sách IP được phép theo từng key
- Tự động nạp từ thẻ đã lưu — số tiền tùy chọn từ $10, bật khi cần
- Webhook cho tác vụ ảnh, video và nhạc
- API sử dụng và xuất CSV
- Endpoint tương thích OpenAI và Anthropic Messages
Start with the popular guides.
- Setup
Gemini API key
Get a Gemini key and call it with the OpenAI SDK — or use one Kunavo key for everything.
Read - Setup
Claude API key
Get a Claude key and call Claude via the OpenAI SDK or the native Messages API.
Read - Pricing
Claude API pricing 2026
Per-model rates ~60% under Anthropic, worked cost examples, and prompt-caching savings.
Read - Pricing
Gemini API pricing 2026
Gemini 3.8 / 3.7 Flash and 2.5 rates per 1M tokens, set against Google's intro pricing, with worked examples.
Read - Pricing
GPT API pricing 2026
GPT-5.5, 5.6 Sol, Terra and Luna rates ~60% under OpenAI's list, with worked examples.
Read - Concept
LLM gateway
One API for every model — routing, fallback, billing, observability and security, explained.
Read - API
OpenAI-compatible API
Point any OpenAI SDK at hosted Claude, Gemini and GPT by changing only base_url.
Read - Tools
LLM cost calculator
Estimate per-request and monthly API cost for Claude, Gemini and GPT — with savings vs list.
Read - Video
Text-to-video API
Generate video from a prompt on an OpenAI-style endpoint — live today on Google Veo 3.1.
Read - Video
Veo 3.1 API
Google Veo 3.1 text-to-video with native audio, ~50–70% under Google's list.
Read - Audio
Suno API
Generate full songs from a prompt via /v1/audio/music — metered per request, no subscription.
Read - Image
Nano Banana API
Google's image models through an OpenAI-compatible endpoint, ~25–50% under Google's list.
Read - Image
GPT-Image-2 API
OpenAI's image model on the OpenAI-compatible images endpoint at about half of list.
Read - Compare
OpenRouter alternative
Kunavo vs OpenRouter — text breadth vs multimodal, pricing, API keys and payments.
Read - Compare
OpenRouter alternatives 2026
Seven honest alternatives by motivation — cheaper, multimodal, BYO-key or open source.
Read - Models
Gemini 3 API
Gemini 3.8 and 3.7 Flash are live — what they cost against Google's introductory rate, and how to call them.
Read - Setup
CC Switch setup
Add Kunavo to CC Switch for Claude Code and Codex — which API format to pick, and why.
Read
Recent deep dives.
- 实战·5 min
在中国稳定调用 Claude / GPT / Gemini — Kunavo 中国友好路由实测
从北京/上海/深圳调用 Kunavo:无需代理即可直连。支付宝/微信支付/双币卡都可用。健壮重试代码 + 何时真的需要代理。
- 教學·6 min
用 Veo 3 為台灣品牌做短影片廣告(Sora 同端點待上線)— 5 分鐘完整教學
從文字 prompt 到 9:16 直式 Reels / TikTok / IG 短影片,全流程教學。圖生影片用既有產品照片動起來。5 種台灣品牌實際應用、繁中文字渲染注意事項、商業可用品質的進階技巧。
- 実装ガイド·8 min
日本語 RAG チャットボットを Claude で構築 — 5,000 文書のナレッジベースを 30 行で
社内ドキュメント 5,000 件を Claude Sonnet 4.6 で検索可能にする RAG 完全実装。1 クエリ約 0.9 円(prompt caching 適用後)。埋め込みは Kunavo では提供しておらず、その工程のみ OpenAI に直接課金されます。日本語特有のトークン消費・ハルシネーション対策・本番投入チェックリスト含む。
Mọi điều
bạn đang băn khoăn.
Không tìm thấy câu trả lời? Viết cho chúng tôi tại contact@kunavo.com — chúng tôi phản hồi trong 24 giờ.
Kunavo được thiết kế riêng cho lập trình viên indie và đội nhỏ đưa tính năng AI lên production. Ba khác biệt thực sự: (1) chúng tôi bao phủ văn bản, hình ảnh, video và nhạc trên một số dư chung; (2) checkout native Stripe, Alipay, Apple Pay, WeChat Pay đều có sẵn — không hóa đơn ngoài nền tảng; (3) minh bạch hoàn toàn trong routing — chúng tôi không bao giờ âm thầm đổi mô hình của bạn sang loại rẻ hơn.
Phần lớn mô hình có giá thấp hơn giá niêm yết chính thức của nhà cung cấp — rẻ hơn tới 70% tùy mô hình; một vài mô hình đúng bằng giá niêm yết, và trang của mô hình đó ghi rõ. Các lần nạp lớn còn cộng thêm tiền thưởng. Bạn cũng tiết kiệm về vận hành: một hợp đồng, một số dư, một SDK, không cam kết tối thiểu. Giá trên mỗi triệu token của từng mô hình được công bố tại /pricing — có thể so sánh với bảng niêm yết upstream bất cứ lúc nào.
Có. Chúng tôi triển khai trọn bộ endpoint của OpenAI: /v1/chat/completions, /v1/embeddings, /v1/images/generations, /v1/models và /v1/video/generations. Streaming, function calling, vision và tool use hoạt động y hệt. Các dự án dùng SDK OpenAI chuyển đổi chỉ bằng cách thay base_url — chỉ vậy thôi.
Không. Kunavo là một ví trả trước. Số tiền nạp ở lại trong tài khoản của bạn mãi mãi — không đăng ký định kỳ, không tối thiểu hàng tháng, không hết hạn. Đóng tài khoản sẽ hoàn số dư còn lại về phương thức thanh toán ban đầu.
Không bao giờ. Phản hồi 4xx và 5xx không bị tính phí. Phản hồi streaming bị ngắt giữa chừng chỉ bị tính phí cho những token đã thực sự được gửi đi. Mọi khoản phí đều hiển thị theo từng lượt gọi trên dashboard mức dùng, có thể xuất ra CSV để hạch toán.
Thẻ (Visa, Mastercard, Amex, JCB, UnionPay), Apple Pay, Link, Cash App Pay, Klarna, Amazon Pay, Alipay và WeChat Pay. Các phương thức nội địa xuất hiện theo quốc gia của người thanh toán — Pix ở Brazil, Bancontact ở Bỉ, BLIK ở Ba Lan, EPS ở Áo, MB WAY ở Bồ Đào Nha — Stripe quy đổi giá USD sang nội tệ ngay tại trang thanh toán. Ghi nợ SEPA, BACS và BECS không nằm trong các phương thức chúng tôi chấp nhận; thẻ phát hành tại những nước đó vẫn dùng bình thường. Tự động nạp là tùy chọn và chỉ dùng thẻ: lưu thẻ một lần, số dư sẽ tự nạp theo số tiền bạn chọn, từ $10.
Kunavo chạy trong một vùng US-East duy nhất (Ashburn, Virginia), phía trước là lớp edge anycast kết thúc TLS gần bạn. Tài khoản, thanh toán và dữ liệu sử dụng nằm trong một cơ sở dữ liệu chính duy nhất, với snapshot volume được mã hóa hằng ngày.
Ba phút đến lượt gọi đầu tiên của bạn.
Một API tương thích OpenAI duy nhất cho Claude, Gemini, GPT-Image và hơn 200 mô hình khác — nạp tối thiểu $10, bạn chỉ trả cho những gì bạn gọi.