RECHNER · Finanzen
KI-API-Kostenrechner
Was Ihre Arbeitslast im Monat auf jedem großen Sprachmodell kostet, mit Preisen, die live aus einer offenen Preisliste gelesen werden.
Formel anzeigen
Methode geprüft:Listenpreise pro Token, mit Long-Context-Stufen und Cache-Lesepreisen, wo angegeben, live aus der offenen Preisliste von LiteLLM gelesen · geprüft im Oktober 2026
Eingaben
0,05 $ pro 1 Mio. Eingabe-Tokens · 0,40 $ pro 1 Mio. Ausgabe-Tokens
API-Aufrufe in einem Monat: 1.000 am Tag sind etwa 30.000.
Eingabe ist alles, was gesendet wird: Systemprompt, Verlauf, Dokumente und die Frage. Die Ausgabe enthält Reasoning-Tokens. 1.000 Tokens sind etwa 750 englische Wörter.
Der Teil jedes Prompts, der sich exakt wiederholt – ein fester Systemprompt oder ein Dokument – und günstiger aus dem Prompt-Cache des Anbieters gelesen wird.
Preise pro 1 Mio. Tokens
Geben Sie Anfragen und Tokens ein, um eine Arbeitslast zu berechnen. Bis dahin sehen Sie hier den Listenpreis jedes Modells.
US-Dollar pro Million Tokens
| Modell | Eingabe / 1 Mio. | Cache / 1 Mio. | Ausgabe / 1 Mio. |
|---|---|---|---|
| gpt-5-nanoOpenAI | 0,05 $ | 0,005 $ | 0,40 $ |
| gpt-6-lunaOpenAI | 0,10 $ | 0,01 $ | 0,50 $ |
| gpt-4o-miniOpenAI | 0,15 $ | 0,075 $ | 0,60 $ |
| gpt-5.6-lunaOpenAI | 0,20 $ | 0,02 $ | 1,20 $ |
| gpt-5.4-nanoOpenAI | 0,20 $ | 0,02 $ | 1,25 $ |
| gpt-5-miniOpenAI | 0,25 $ | 0,025 $ | 2,00 $ |
| gpt-4.1-miniOpenAI | 0,40 $ | 0,10 $ | 1,60 $ |
| gpt-5.4-miniOpenAI | 0,75 $ | 0,075 $ | 4,50 $ |
| gpt-5OpenAI | 1,25 $ | 0,125 $ | 10,00 $ |
| gpt-5.1OpenAI | 1,25 $ | 0,125 $ | 10,00 $ |
| gpt-5.2OpenAI | 1,75 $ | 0,175 $ | 14,00 $ |
| gpt-5.3-codexOpenAI | 1,75 $ | 0,175 $ | 14,00 $ |
Angezeigt wird die Liste vom 02.10.2026. Ihr Browser sucht beim Öffnen der Seite nach neueren Preisen.
Quelle: die offene Preisliste von LiteLLM, die anhand der Preisseiten der Anbieter aktuell gehalten wird. Offizielle Preise von OpenAI prüfen
Standard-Listenpreise in US-Dollar ohne Steuern. Batch-, Priority- und regionale Endpunkte, Cache-Schreibvorgänge, Tools und Bilder werden anders abgerechnet.
So funktioniert es
- Wählen Sie ein Modell. Die Preise werden beim Öffnen der Seite live aus der offenen Preisliste von LiteLLM geladen; der Kasten unter dem Ergebnis zeigt, wann sie geprüft wurden.
- Geben Sie die Anfragen pro Monat ein, die durchschnittlichen Eingabe- und Ausgabe-Tokens pro Anfrage und den Anteil der Eingabe, den Ihr Prompt-Cache liefert.
- Lesen Sie die Kosten pro Monat und Jahr ab, die Aufteilung auf Eingabe und Ausgabe und dieselbe Arbeitslast auf jedem anderen Modell berechnet.
Häufige Fragen
Wie viele Tokens hat ein Wort?
Im Englischen etwa drei Viertel eines Wortes pro Token, 1.000 Tokens sind also rund 750 Wörter. Andere Sprachen – auch Deutsch –, Code und Zahlen brauchen mehr Tokens pro Wort, und jede Modellfamilie hat ihren eigenen Tokenizer; die Nutzungsangaben in den API-Antworten liefern Ihre genauen Zahlen.
Warum kosten Ausgabe-Tokens mehr als Eingabe-Tokens?
Die Ausgabe entsteht Token für Token, während die ganze Eingabe in einem Durchgang gelesen wird; deshalb berechnen die Anbieter die Ausgabe mit einem Vielfachen des Eingabepreises. Reasoning-Modelle rechnen ihr verborgenes Nachdenken ebenfalls als Ausgabe ab – darum treibt langes Reasoning die Rechnung hoch.
Was ist Prompt-Caching?
Wiederholt sich der Anfang eines Prompts zwischen Anfragen exakt – ein langer Systemprompt oder ein Dokument –, liefern die Anbieter ihn aus einem Cache und berechnen nur einen Bruchteil des Eingabepreises. Tragen Sie den Anteil der Eingabe ein, der sich wiederholt, um die Ersparnis zu sehen; die erste Anfrage, die den Cache schreibt, kann etwas mehr kosten, was diese Seite weglässt.
Woher kommen die Preise und wie aktuell sind sie?
Aus der offenen Preisliste von LiteLLM, die ihre Betreuer an die Preisseite jedes Anbieters angleichen, meist wenige Tage nach einer Änderung. Die Seite liest sie live in Ihrem Browser und zeigt, wann sie zuletzt geprüft hat; ist die Liste nicht erreichbar, zeigt sie die gespeicherte Kopie mit Datum. Prüfen Sie vor einer Budgetentscheidung die Seite des Anbieters selbst.
Beispiele
- Ein Modell zu 1 $ pro Million Eingabe-Tokens und 4 $ pro Million Ausgabe-Tokens: 10.000 Anfragen im Monat mit 2.000 Eingabe- und 500 Ausgabe-Tokens
- 0,004 $ pro Anfrage: 40 $ im Monat und 480 $ im Jahr, je zur Hälfte für Eingabe und Ausgabe.
- Dieselbe Arbeitslast, wenn die Hälfte jedes Prompts aus einem Cache zu 0,10 $ pro Million kommt
- 31 $ im Monat: Die gecachte Hälfte der Eingabe kostet 1 $ statt 10 $.
Ähnliche Rechner
- WährungsumrechnerRechnen Sie unterstützte Währungen mit einem kostenlosen stündlichen Referenzkurs und täglichen Fallbacks um.Umrechner
- Stundensatzrechner für FreelancerDer Stunden- und Tagessatz, der Ihr Wunscheinkommen, Steuern, Betriebskosten und die Stunden deckt, die Sie wirklich abrechnen können.Finanzen
- Break-even-ROAS-RechnerDer Return on Ad Spend, ab dem eine Bestellung kein Geld mehr verliert, die höchsten Werbekosten pro Verkauf und der ROAS, den Ihre Zielmarge braucht.Finanzen
- ROI-RechnerKapitalrendite als Prozentsatz und absoluter Gewinn oder Verlust.Finanzen
- ProzentrechnerDrei Prozentfragen in einem Tool: P % von X, X sind wie viel % von Y, X sind P % von wovon.Mathematik