LLM-API-Kostenrechner

Tragen Sie aktuelle Vertragspreise und Nutzungsannahmen ein. Cache-Tokens sind Teil der gesamten Eingabe; die Hochrechnung ist kein Preisangebot des Anbieters.

Läuft lokal in deinem Browser
Sie tragen die Preise selbst ein; veraltete Provider-Tarife werden nicht verwendet. Alle Berechnungen bleiben im Browser.
Nutzung pro Anfrage
Anfragevolumen
Kostenprognose
Geschätzte Monatskosten—

Aktuelle Vertragspreise verwenden

Provider ändern Modelle, Rabatte, Cache-Regeln und regionale Preise. Übernehmen Sie Tarife aus Ihrer Abrechnungsquelle und modellieren Sie Durchschnitts- und Spitzenvolumen.

LLM-API-Kosten schätzen

Tragen Sie die Tokens einer Anfrage ein — Gesamteingabe, davon Cache, Ausgabe —, legen Sie das Anfragevolumen und die drei Preise pro Million Tokens aus Ihrem Vertrag fest. Die Seite rechnet den Aufwand pro Anfrage, Tag und Monat hoch.

Die Arithmetik läuft in diesem Browser, und die eingegebenen Zahlen werden nicht hochgeladen. Weil die Preise von Ihnen stammen, folgt die Hochrechnung jeder aktuellen Preisliste des Anbieters – und bleibt eine Planungsgröße, keine Rechnung.

  1. Tokens einer Anfrage eintragen: Gesamteingabe, der zwischengespeicherte Teil davon und die Ausgabe. Cache-Tokens dürfen die Eingabe nicht überschreiten; sonst warnt die Seite, statt zu rechnen.
  2. Anfragevolumen festlegen: Anfragen pro Tag und abgerechnete Tage im Monat.
  3. Preise für Eingabe, Cache-Eingabe und Ausgabe pro 1 Million Tokens laut Vertrag eintragen und bei Bedarf das Währungssymbol ändern; es werden bis zu 4 Zeichen angezeigt.
  4. Projektion lesen: pro Anfrage, Tag und Monat sowie Monatstokens und Cache-Ersparnis. Jedes Feld rechnet beim Tippen neu; Beispielwerte laden setzt die Standardwerte, Leeren setzt das Formular zurück.

Wie die Projektion berechnet wird

Die Formel hinter jeder Zahl

Kosten pro Anfrage = ((Eingabe − Cache) × Eingabepreis + Cache × Cache-Preis + Ausgabe × Ausgabepreis) ÷ 1.000.000. Der Tageswert multipliziert mit den Anfragen pro Tag, der Monatswert mit den eingestellten Abrechnungstagen.

Die Cache-Ersparnis rechnet die Cache-Tokens in Geld um: Was sie zum vollen Eingabepreis gekostet hätten, minus was sie zum Cache-Preis kosten – über den Abrechnungsmonat. Monatstokens addieren Eingabe und Ausgabe jeder Anfrage. Beträge unter 0,01 erscheinen mit bis zu sechs Nachkommastellen, größere mit zwei.

Was die Projektion nicht enthält

Es zählen nur die drei eingegebenen Preise. Separat abgerechnete Posten — Mindestumsätze, Batch- oder Volumenrabatte, Cache-Schreibgebühren, Bild- oder Audio-Tokens — stecken nicht in der Formel und müssen manuell ergänzt werden. Auch Tokenizer-Zählungen des Anbieters können von Ihren Zahlen abweichen.

Preise, Modellpalette und Cache-Regeln ändern sich im Rhythmus des Anbieters. Behandeln Sie das Ergebnis als Planungsgröße und prüfen Sie es an einer echten Rechnung, bevor es in ein Budget einfließt.

Privat von Haus aus

Die Berechnung ist Browser-JavaScript. Bei geladener Seite lösen Feldänderungen und Berechnen keine Netzwerkanfrage aus, und Tokens, Volumen und Preise werden nicht gespeichert.

Dadurch bleibt das Werkzeug offline nutzbar und für Zahlen geeignet, die Sie keinem Drittanbieter geben würden. Da dieselbe Formel gilt, sollte eine Tabelle mit identischen Werten dasselbe Ergebnis liefern.

Zuletzt verwendet: