GPT-5.6 LunaAPI
GPT-5.6 fast tier — high-volume, low-latency execution at mini-class cost.
Harga input
$0.07
per 1M tokens
Harga output
$0.42
per 1M tokens
Prompt caching
Kirim cache_control pada prefiks stabil — hit cache ditagih sepersekian dari harga input. Tulis cache ditagih dengan tarif tulis penyedia: 1,25× input di Claude dan GPT-5.6+, harga input di model lain.
Dihitung otomatis sebagai input × 0.1
Untuk prompt di atas 272K token, seluruh permintaan ditagih $0.14 input / $0.63 output per juta token.
Spesifikasi
- ID model
gpt-5-6-luna- Endpoint
POST /v1/chat/completions- Kategori
- Text
- Penyedia
- OpenAI
- Jendela konteks (token)
- 1,050,000
- Output maks. (token)
- 128,000
- Kemampuan
- functionstreaminglong-context
Kompatibilitas drop-in OpenAI
Arahkan SDK OpenAI kamu ke api.kunavo.com/v1 dan ganti ID model. Tanpa perubahan streaming, tanpa SDK baru.
Lihat dokumenGPT API pricing guideCoba sendiri
Atur KUNAVO_API_KEY dari /app/keys dan jalankan snippet di bawah.
curl https://api.kunavo.com/v1/chat/completions \
-H "Authorization: Bearer $KUNAVO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5-6-luna",
"messages": [
{"role": "user", "content": "Hello, GPT-5.6 Luna"}
],
"stream": false
}'Kunavo vs memanggil OpenAI langsung
Model GPT-5.6 Luna dan responsnya sama persis. Yang diubah gateway adalah akun, SDK, dan tagihan — ini perbandingan jujurnya.
| Kunavo | OpenAI langsung | |
|---|---|---|
| Harga (per 1M tokens) | $0.07 / $0.42 (−65%) | $0.20 / $1.20 |
| Akun | Satu akun Kunavo, kunci dalam 2 menit, isi ulang minimum $10 | Akun OpenAI beserta pengaturan penagihannya sendiri |
| SDK | Tetap pakai OpenAI SDK — ganti base_url, isi model dengan "gpt-5-6-luna" | SDK milik OpenAI, atau lapisan kompatibel-OpenAI bila tersedia |
| Kunci yang sama juga menjangkau | Claude, Gemini, GPT plus model gambar, video, dan audio | Hanya katalog OpenAI sendiri |
| Penagihan | Satu saldo Stripe, bayar sesuai pemakaian, tidak pernah hangus; permintaan gagal tidak ditagih | Faktur terpisah untuk tiap penyedia |
| Batas laju | Kapasitas gateway bersama, tanpa batas kontraktual per akun | Batas tier OpenAI sendiri, dinaikkan lewat riwayat pemakaian atau kontrak |
Pilih OpenAI langsung bila Anda butuh batas laju kontraktual, SLA enterprise, atau fitur khusus penyedia sejak hari pertama. Kunavo cocok bila Anda ingin satu kunci, satu saldo, dan harga per token lebih rendah di semua penyedia.
FAQ
How much does GPT-5.6 Luna cost?
On Kunavo, GPT-5.6 Luna is $0.07 per 1M input tokens and $0.42 per 1M output tokens — about 65% under OpenAI's official price. Failed requests are never billed, and it's pay-as-you-go — you only pay for successful calls.
Can I call GPT-5.6 Luna with the OpenAI SDK?
Yes. Set base_url to https://api.kunavo.com/v1, pass your Kunavo key, and set model to "gpt-5-6-luna". Requests and responses are OpenAI-compatible.
What endpoint does GPT-5.6 Luna use?
GPT-5.6 Luna is called via POST /v1/chat/completions on Kunavo's OpenAI-compatible API.
What is GPT-5.6 Luna good for?
GPT-5.6 Luna is a text model from OpenAI, with support for function, streaming, long-context.
What is different from calling OpenAI directly?
The model is the same, at about 65% under OpenAI's list price. What changes is around it: one key and one Stripe balance instead of a OpenAI account with its own billing, the OpenAI SDK with base_url swapped instead of a provider-specific SDK, and the same key also reaching Claude, Gemini, GPT, image, video and audio models. The tradeoff is that gateway capacity is shared — if you need a contractual rate limit or an enterprise SLA on GPT-5.6 Luna specifically, go direct to OpenAI.
Is GPT-5.6 Luna cheaper on Kunavo?
Yes — GPT-5.6 Luna is about 65% under OpenAI's official list price on Kunavo, with no subscription and no minimum monthly spend. You pay per token from a $10 top-up, failed requests are never billed, and the balance never expires.