Token-Rechner
Kostenlos, sofort, ohne Anmeldung. Tragen Sie Input-, Output- und gecachte Tokens pro Anfrage sowie Ihr Monatsvolumen ein — der Rechner zeigt Kosten pro Anfrage und pro Monat für 24 Claude-, GPT- und Gemini-Modelle, jedes neben dem Listenpreis seines Anbieters. Die Tarife kommen live aus dem Katalog.
Your workload
Rate: $1.20 in / $6.00 out · cache hit $0.1200 · cache write $1.50 — all per 1M tokens, read live from the Kunavo catalog.
Estimated cost
You save vs Anthropic list
$450/ month · ~60%
Estimate only. Reasoning models bill hidden reasoning tokens at the output rate, so a reasoning workload costs more than the output box suggests. Cache writes are billed separately at $1.50 per 1M and are not in this figure — they are a one-off per cache entry, not per request. Failed requests are never billed.
Preis-Guides je Modellfamilie
Cache-Treffer zu einem Zehntel
Cached Input und Reasoning-Tokens
Haiku- / Sonnet- / Opus-Tarife
Flash / Pro und die Gratis-Stufe
GPT-Tarife pro Modell
Eine API für jedes Modell
Preis pro Bild
Alle Modelle, gegen Liste
Wie berechnet man die Kosten von LLM-Tokens?
LLM-APIs rechnen pro Million Tokens ab, wobei Input und Output unterschiedliche Tarife haben. Eine Anfrage kostet also (Input-Tokens ÷ 1.000.000 × Input-Tarif) + (Output-Tokens ÷ 1.000.000 × Output-Tarif). Output ist typischerweise ein Mehrfaches des Inputs — deshalb kann ein kurzer Prompt mit langer Antwort teurer sein als ein langer Prompt mit kurzer Antwort. Die Monatskosten sind dieser Betrag mal Anfragevolumen, und gecachter Input kommt als dritter Posten zu einem Bruchteil des Input-Tarifs hinzu.
Zählt dieser Token-Rechner Tokens aus Text?
Nein — der Rechner bepreist Token-Zahlen, die Sie eingeben, er tokenisiert keinen Text. Tragen Sie Input-, Output- und gecachte Tokens pro Anfrage ein, und Sie erhalten Kosten pro Anfrage und pro Monat. Echte Token-Zahlen lesen Sie aus dem usage-Feld, das Ihre API-Antworten ohnehin zurückgeben — Schätzungen über Zeichenzahlen weichen je nach Sprache und Tokenizer stark ab.
Ist dieser Token-Rechner kostenlos?
Ja. Der Rechner ist kostenlos, läuft im Browser und braucht weder Anmeldung noch API-Key. Die Tarife werden live aus dem Kunavo-Modellkatalog gelesen, und jedes Modell steht neben dem veröffentlichten Listenpreis seines Anbieters — der Vergleich ist damit auf der Preisseite des Anbieters nachprüfbar.
Welche LLM-API ist für meine Anwendung am günstigsten?
Das hängt am Verhältnis von Input zu Output, und genau deshalb lohnt sich Vergleichen statt Annehmen. Eine Anwendung, die viel Kontext schickt und kurz antwortet, wird vom Input-Tarif dominiert; eine, die lange Texte erzeugt, vom Output — und dort ist der Abstand zwischen den Stufen am größten. Tragen Sie Ihre eigenen Token-Zahlen ein und lesen Sie die Monatsspalte: Das günstigste Modell für Zusammenfassungen ist selten auch das günstigste für Chat.
Warum ist meine echte Rechnung höher als der Rechner sagt?
Drei Dinge, die eine Schätzung pro Anfrage auslässt. Reasoning-Tokens werden als Output abgerechnet, obwohl sie nie in der Antwort erscheinen. Cache-Writes werden einmal pro Cache-Eintrag abgerechnet und liegen außerhalb des Betrags pro Anfrage. Und Wiederholungen kosten: Eine fehlgeschlagene Anfrage, die Tokens verbraucht hat, wird trotzdem berechnet. Am größten ist der Abstand bei agentischen Werkzeugen, weil eine für den Nutzer sichtbare Aufgabe viele abgerechnete Durchläufe sind.