# LLM-API-Kostenrechner

*Quelle: https://www.provimedia.de/tools/llm-kosten-rechner*

> Was kostet GPT-5, Claude oder Gemini im Monat? Anfragen und Tokens eingeben, API-Kosten aller Modelle vergleichen.

Was kostet die GPT-, Claude- oder Gemini-API? Anfragen und Tokens eingeben, Monatskosten in USD und Euro vergleichen – kostenlos und ohne Anmeldung.

## Häufige Fragen

### Was kostet die ChatGPT-API pro Monat?

Das hängt von Anfragen und Token-Volumen ab. Beispiel: Ein Chatbot mit 10.000 Anfragen pro Monat (durchschnittlich 800 Input- und 300 Output-Tokens je Anfrage) kostet mit GPT-5 (1,25 USD Input / 10 USD Output pro 1 Mio. Tokens) rund 40 US-Dollar im Monat, mit GPT-5 mini rund 8 US-Dollar. Die Formel: Anfragen × (Input-Tokens ÷ 1 Mio. × Input-Preis + Output-Tokens ÷ 1 Mio. × Output-Preis).

### Wie berechnen sich die Kosten einer LLM-API?

Alle großen Anbieter rechnen pro Token ab, getrennt nach Input (Ihr Prompt inklusive Kontext) und Output (die Antwort des Modells). Output-Tokens sind dabei deutlich teurer als Input-Tokens — bei den gängigen Modellen um den Faktor 3 bis 8. Die Monatskosten ergeben sich aus: Anzahl der Anfragen × (Input-Tokens ÷ 1 Mio. × Input-Preis + Output-Tokens ÷ 1 Mio. × Output-Preis). Genau diese Rechnung führt der Rechner oben für alle ausgewählten Modelle gleichzeitig aus.

### Was ist ein Token und wie viele Tokens hat ein Text?

Ein Token ist die kleinste Abrechnungseinheit eines Sprachmodells — im Deutschen entspricht ein Token grob 3 bis 4 Zeichen. Eine DIN-A4-Seite Text mit rund 3.000 Zeichen sind etwa 750 bis 1.000 Tokens. 1 Million Tokens — die übliche Preiseinheit der Anbieter — entsprechen damit ungefähr 1.000 bis 1.300 Seiten Text.

### Welches LLM ist am günstigsten?

Für einfache, hochvolumige Aufgaben sind Effizienz-Modelle am günstigsten: GPT-5 mini (0,25 USD Input / 2 USD Output pro 1 Mio. Tokens) und Claude Haiku 4.5 (1 USD / 5 USD). Frontier-Modelle wie die Claude-Opus-Klasse (5 USD / 25 USD) lohnen sich nur für komplexes Reasoning oder anspruchsvolle Code-Aufgaben. Beim identischen Chatbot-Workload mit 10.000 Anfragen pro Monat liegt der Unterschied bei 23 US-Dollar (Haiku 4.5) gegenüber 115 US-Dollar (Opus-Klasse) — Faktor 5.

### Wie kann ich meine LLM-API-Kosten senken?

Die fünf wirksamsten Hebel: Erstens ein kleineres Modell oder Model-Routing einsetzen — einfache Teilaufgaben ans günstige Modell, nur komplexe ans teure. Zweitens Prompt-Caching nutzen: wiederholte Prompt-Teile werden je nach Anbieter mit bis zu 90 Prozent Rabatt abgerechnet. Drittens Batch-APIs für Nicht-Echtzeit-Jobs verwenden (typischerweise rund 50 Prozent Rabatt). Viertens System-Prompts und mitgeschickten Kontext kürzen, denn Input-Tokens zahlen bei jeder Anfrage erneut ein. Fünftens die Output-Länge begrenzen, weil Output-Tokens am teuersten sind.

---

Kanonische Version: <https://www.provimedia.de/tools/llm-kosten-rechner>
