KI · LLM · API

Tokens rein.
Kosten raus.

Berechne Input-, Output- und Gesamtkosten mit deinen eigenen Preisen. Ohne Modellbindung, ohne Datenupload.

Tokenkosten berechnen
tokenrechner / kostenLIVE

01input = 420 × 10.0004,20 Mio.

02output = 650 × 10.0006,50 Mio.

03preis = (4,2 × 2 €) + (6,5 × 8 €)

GESAMTKOSTEN60,40 €0,006040 € / Anfrage
Freie Preise pro Mio. TokensTextschätzung als OrientierungLokal verarbeitet im Browser

01 / KOSTENRECHNER

Was kostet dein Tokenvolumen?

Trage die Preise des tatsächlich verwendeten Modells ein. Die Vorgaben sind nur ein Rechenbeispiel und keine aktuelle Preisauskunft.

PARAMETERPro Anfrage
PREIS PRO 1 MILLION TOKENSeigene Anbieterpreise eintragen

Alle Eingaben werden ausschließlich in deinem Browser berechnet.

GESAMTKOSTENERGEBNIS / EUR
Input
Output
TokenvolumenInput + Output

Preisänderungen, Rabattstufen, Cache-Tokens und weitere Anbietergebühren sind nicht automatisch enthalten.

02 / TEXTSCHÄTZUNG

Text grob in Tokens übersetzen.

Tokenizer unterscheiden sich je nach Modell, Sprache und Inhalt. Die Schätzung mit etwa vier Zeichen pro Token ist deshalb nur ein Richtwert.

GESCHÄTZT0Tokens
SPANNWEITE0–0Tokens
TEXT0Zeichen · 0 Wörter
TEXT / LOKAL0 Zeichen

03 / EINORDNUNG

Drei Werte, ein klares Budget.

Formel ansehen
IN

Input

Alles, was an das Modell gesendet wird: Prompt, Systemanweisungen, Verlauf und beigefügter Kontext.

OUT

Output

Die vom Modell erzeugte Antwort. Anbieter können dafür einen anderen Preis als für Input berechnen.

Σ

Gesamt

Tokenmenge mal Preis, getrennt für Input und Output. Beide Beträge ergeben die Gesamtkosten.

KI-Nutzung und Modellkosten abschätzen

Tokenrechner: Ergebnis verstehen und richtig einordnen

Sprachmodelle rechnen Texte nicht direkt nach Wörtern, sondern nach Tokens ab. Der Rechner trennt Eingabe, Ausgabe und gegebenenfalls wiederverwendete Kontextanteile, damit Kosten pro Anfrage und Zeitraum planbar werden.

01

Passende Eingaben

Nutze Tokenmengen und Preise des tatsächlich verwendeten Modells und Tarifs. Eingabe- und Ausgabepreise sowie Cache-Regeln können unterschiedlich sein.

02

Ergebnis lesen

Die Kosten pro Anfrage sind eine Multiplikation der jeweiligen Tokenklassen mit ihren Preisen. Für Budgets müssen Anfragenzahl, Antwortlänge und mögliche Fehlversuche hinzugerechnet werden.

03

Grenzen beachten

Aktuelle Modellpreise, Rundungsregeln, Batch- oder Cache-Rabatte, Bild- und Audiotokens sowie Toolnutzung können sich je Anbieter und Produkt ändern.

Glossar

Wichtige Begriffe kurz erklärt

Die Definitionen helfen dir, Eingaben, Rechenweg und Ergebnis fachlich einzuordnen.

Token
Kleine Verarbeitungseinheit eines Sprachmodells. Ein Token kann ein Wortteil, Satzzeichen, Leerraum oder ein kurzes Wort repräsentieren.
Input-Token
Token, die als Anweisung, Nutzereingabe, Systemtext oder Kontext an das Modell gesendet werden.
Output-Token
Token, die das Modell in seiner Antwort erzeugt. Sie können einen anderen Preis als Eingabetokens haben.
Kontextfenster
Maximale Tokenmenge, die ein Modell innerhalb einer Anfrage verarbeiten kann, einschließlich Eingabe und erzeugter Ausgabe.
Cached Input
Unter bestimmten Produktbedingungen wiederverwendeter Eingabekontext, der anders bepreist werden kann als neue Eingabetokens.
Preis pro Million Tokens
Übliche Preiseinheit für Modellnutzung. Zur Berechnung wird die konkrete Tokenzahl durch eine Million geteilt und mit dem Tarif multipliziert.

FAQ

Häufige Fragen zum Tokenrechner

Antworten auf typische Fragen, die vor oder nach der Berechnung entstehen.

Wie viele Wörter sind ein Token?

Es gibt keinen festen Faktor. Sprache, Wortlänge, Satzzeichen, Code und Formatierung beeinflussen die Tokenisierung.

Zählen Systemprompt und Chatverlauf mit?

In der Regel ja, soweit sie als Kontext an das Modell übermittelt werden. Die genaue Abrechnung hängt von Produkt und API ab.

Warum kosten Ausgabetokens oft anders als Eingabetokens?

Das Erzeugen neuer Tokens hat ein anderes Rechenprofil als das Verarbeiten von Kontext; Anbieter legen dafür getrennte Tarife fest.

Kann ich die Monatskosten exakt vorhersagen?

Nur bei stabilen Tokenmengen und Anfragenzahlen. Für Planung ist ein Puffer für längere Antworten, Wiederholungen und Preisänderungen sinnvoll.