LLM-API-Kostenrechner

Geben Sie Ihre Token-Mengen und die Preise Ihres Anbieters ein und sehen Sie, was ein Chatbot, Assistent oder eine Automatisierung kostet, bevor Sie sie bauen.

Ihre Nutzung
Prompt, Anweisungen und Kontext, die Sie jedes Mal mitsenden.
Länge der Antwort des Modells.
30 für dauerhaft laufende Anwendungen, etwa 21 für Nutzung zu Bürozeiten.
Nur wenn Ihr Anbieter Prompt-Caching anbietet. Sonst bei 0 lassen.
Preisszenarien (pro 1 Million Tokens)

Die Startwerte sind Beispielwerte zur Veranschaulichung, keine aktuellen Preise eines Anbieters. Ersetzen Sie sie durch die Preise auf der Preisseite Ihres Anbieters.

Geschätzte Kosten

Name des SzenariosKleines Modell (Beispiel)Mittleres Modell (Beispiel)Großes Modell (Beispiel)
Pro Anfrage0,00062 $0,00310 $0,02 $
Pro 1.000 Anfragen0,62 $3,10 $15,50 $
Pro Tag0,12 $0,62 $3,10 $
Pro Monat3,72 $18,60 $93,00 $
Pro Jahr44,64 $223,20 $1.116,00 $
Tokens pro Monat
11.400.000
Niedrigste Monatskosten
3,72 $
Kleines Modell (Beispiel)

Tokens aus einem Beispieltext schätzen

Fügen Sie einen typischen Prompt oder eine Antwort ein. Die Schätzung nutzt gängige Faustregeln (etwa 4 Zeichen pro Token); die echte Zahl hängt vom Tokenizer des Modells und der Sprache ab. Deutsche Texte brauchen meist mehr Tokens als englische.

Wörter
0
Zeichen
0
Geschätzte Tokens
≈ 0

Läuft komplett in Ihrem Browser. Es werden keine Daten an einen Server gesendet.

So funktioniert's

  1. Geben Sie die durchschnittlichen Input- und Output-Tokens pro Anfrage ein. Wenn Sie unsicher sind, fügen Sie unten einen typischen Prompt oder eine Antwort in den Schätzer ein und übernehmen Sie das Ergebnis.
  2. Legen Sie fest, wie viele Anfragen Sie pro Tag und an wie vielen Tagen im Monat erwarten.
  3. Ersetzen Sie die Beispielpreise durch die aktuellen Preise pro Million Tokens von der Preisseite Ihres Anbieters. Sie können jedes Szenario umbenennen.
  4. Unterstützt Ihr Anbieter Prompt-Caching, geben Sie den Anteil des wiederverwendeten Inputs und den Cache-Preis ein.
  5. Lesen Sie in der Ergebnistabelle die Kosten pro Anfrage, Tag, Monat und Jahr für jedes Szenario ab.

Häufige Fragen

Sind die voreingestellten Preise echt?

Nein. Es sind runde Beispielwerte, die zeigen, wie die Rechnung funktioniert. Preise ändern sich oft und unterscheiden sich je nach Anbieter und Modell. Tragen Sie immer die aktuellen Werte von der Preisseite Ihres Anbieters ein.

Wie werden die Kosten pro Anfrage berechnet?

Input-Tokens mal Input-Preis plus Output-Tokens mal Output-Preis, jeweils geteilt durch eine Million. Gecachte Input-Tokens werden zum Cache-Preis statt zum normalen Input-Preis berechnet.

Wie viele Tokens hat ein Wort?

Als Faustregel entspricht ein Token etwa vier Zeichen. Deutsche Texte brauchen wegen langer Wörter meist mehr Tokens als englische. Die genaue Zahl hängt vom Tokenizer des Modells ab.

Warum sind Output-Tokens meist teurer?

Text zu erzeugen ist rechenintensiver als ihn zu lesen, daher verlangen die meisten Anbieter für Output einen höheren Preis. Lange Antworten können die Rechnung deshalb dominieren.

Sind Steuern oder Abogebühren enthalten?

Nein. Der Rechner schätzt nur nutzungsabhängige API-Kosten. Umsatzsteuer, Plattformgebühren, Mindestumsätze oder Tool-Abos kommen separat hinzu.

Ähnliche Artikel

KI-Strategie8 Min. Lesezeit

Das richtige LLM für Ihr Unternehmen auswählen

So wählen Sie ein LLM fürs Unternehmen: Aufgabe definieren, Testset bauen, Qualität, Kosten, Tempo und Datenbedingungen vergleichen, per Scorecard entscheiden.

Kosten & ROI8 Min. Lesezeit

LLM-API-Kosten senken: 12 praxiserprobte Taktiken

Zwölf praktische Wege, LLM-API-Kosten ohne Qualitätsverlust zu senken: Modell-Routing, Prompt-Caching, kürzerer Kontext, Output-Limits, Batching, Monitoring.

Kosten & ROI7 Min. Lesezeit

Was sind Tokens bei LLMs? Einfach erklärt

Was Tokens bei LLMs sind, wie Text zerlegt wird, warum Sprachen und Formate sich unterscheiden und wie Tokens Kontextgrenzen, Tempo und API-Kosten bestimmen.

Weitere Tools

KI-ROI-Rechner für Automatisierung

Berechnen Sie den ROI einer KI-Automatisierung: gesparte Stunden, Nettonutzen pro Monat, Amortisation und Rendite im ersten Jahr – inkl. Prüfzeit und Kosten.

KI-Prompt-Generator

Erstellen Sie strukturierte Prompts für ChatGPT, Claude, Gemini und andere KI-Assistenten aus Rolle, Aufgabe, Kontext und Format. Kostenlos, mit Vorlagen.

EU AI Act Risikoklassen-Check

Finden Sie mit wenigen Fragen heraus, in welche Risikoklasse des EU AI Act Ihr KI-System wohl fällt und welche Pflichten relevant sind. Keine Rechtsberatung.