CALCULATOR · Financieel
AI-API-kostencalculator
Wat je werklast per maand kost op elk groot taalmodel, met prijzen die live uit een open prijslijst worden gelezen.
Formule tonen
Methode beoordeeld:Lijstprijzen per token, met long-contexttreden en cache-leesprijzen waar vermeld, live gelezen uit de open prijslijst van LiteLLM · gecontroleerd in oktober 2026
Invoer
US$ 0,05 per 1 mln. inputtokens · US$ 0,40 per 1 mln. outputtokens
API-aanroepen in een maand: 1.000 per dag is ongeveer 30.000.
Input is alles wat je verstuurt: systeemprompt, gespreksgeschiedenis, documenten en de vraag. Output omvat redeneertokens. 1.000 tokens is ongeveer 750 Engelse woorden.
Het deel van elke prompt dat zich precies herhaalt — een vaste systeemprompt of een document — en dat de aanbieder goedkoper uit zijn promptcache leest.
Prijzen per 1 mln. tokens
Vul je verzoeken en tokens in om een werklast te berekenen. Tot die tijd zie je hier de lijstprijs van elk model.
Amerikaanse dollars per miljoen tokens
| Model | Input / 1 mln. | Cache / 1 mln. | Output / 1 mln. |
|---|---|---|---|
| gpt-5-nanoOpenAI | US$ 0,05 | US$ 0,005 | US$ 0,40 |
| gpt-6-lunaOpenAI | US$ 0,10 | US$ 0,01 | US$ 0,50 |
| gpt-4o-miniOpenAI | US$ 0,15 | US$ 0,075 | US$ 0,60 |
| gpt-5.6-lunaOpenAI | US$ 0,20 | US$ 0,02 | US$ 1,20 |
| gpt-5.4-nanoOpenAI | US$ 0,20 | US$ 0,02 | US$ 1,25 |
| gpt-5-miniOpenAI | US$ 0,25 | US$ 0,025 | US$ 2,00 |
| gpt-4.1-miniOpenAI | US$ 0,40 | US$ 0,10 | US$ 1,60 |
| gpt-5.4-miniOpenAI | US$ 0,75 | US$ 0,075 | US$ 4,50 |
| gpt-5OpenAI | US$ 1,25 | US$ 0,125 | US$ 10,00 |
| gpt-5.1OpenAI | US$ 1,25 | US$ 0,125 | US$ 10,00 |
| gpt-5.2OpenAI | US$ 1,75 | US$ 0,175 | US$ 14,00 |
| gpt-5.3-codexOpenAI | US$ 1,75 | US$ 0,175 | US$ 14,00 |
Je ziet de lijst van 2 okt 2026. Je browser zoekt naar nieuwere prijzen zodra de pagina opent.
Bron: de open prijslijst van LiteLLM, bijgehouden aan de hand van de prijspagina van elke aanbieder. Bekijk de officiële prijzen van OpenAI
Standaard lijstprijzen in Amerikaanse dollars, zonder belasting. Batch-, prioriteits- en regionale endpoints, cache-schrijfacties, tools en afbeeldingen worden anders berekend.
Zo werkt het
- Kies een model. De prijzen laden live uit de open prijslijst van LiteLLM zodra de pagina opent, en het kader onder het resultaat toont wanneer ze zijn gecontroleerd.
- Vul de verzoeken per maand in, de gemiddelde input- en outputtokens per verzoek en het deel van de input dat je promptcache levert.
- Lees de kosten per maand en per jaar af, de verdeling tussen input en output en dezelfde werklast berekend op elk ander model.
Veelgestelde vragen
Hoeveel tokens is een woord?
In het Engels ongeveer driekwart woord per token, dus 1.000 tokens is zo’n 750 woorden. Andere talen, ook het Nederlands, code en getallen gebruiken meer tokens per woord, en elke modelfamilie heeft een eigen tokenizer; de gebruikscijfers in de API-antwoorden geven je exacte aantallen.
Waarom kosten outputtokens meer dan inputtokens?
Output wordt token voor token gegenereerd, terwijl de hele input in één keer wordt gelezen; daarom rekenen aanbieders voor output een veelvoud van de inputprijs. Redeneermodellen rekenen hun verborgen redenering ook als output, en daarom maakt lang redeneren de rekening hoger.
Wat is promptcaching?
Als het begin van een prompt zich tussen verzoeken precies herhaalt — een lange systeemprompt of een document —, leveren aanbieders het uit een cache en rekenen ze maar een fractie van de inputprijs. Vul het deel van de input in dat zich herhaalt om de besparing te zien; het eerste verzoek, dat de cache vult, kan iets meer kosten, en dat laat deze pagina weg.
Waar komen de prijzen vandaan en hoe actueel zijn ze?
Uit de open prijslijst van LiteLLM, die de beheerders gelijk houden met de prijspagina van elke aanbieder, meestal binnen een paar dagen na een wijziging. De pagina leest hem live in je browser en toont wanneer ze voor het laatst controleerde; is de lijst onbereikbaar, dan zie je de opgeslagen kopie met datum. Controleer de pagina van de aanbieder zelf voordat je een budget vastlegt.
Voorbeelden
- Een model van $ 1 per miljoen inputtokens en $ 4 per miljoen outputtokens: 10.000 verzoeken per maand van 2.000 input- en 500 outputtokens
- $ 0,004 per verzoek: $ 40 per maand en $ 480 per jaar, half voor input en half voor output.
- Dezelfde werklast als de helft van elke prompt uit een cache van $ 0,10 per miljoen komt
- $ 31 per maand: de gecachte helft van de input kost $ 1 in plaats van $ 10.
Gerelateerde calculators
- ValutaconverterConverteer ondersteunde wereldvaluta's met een gratis uurlijkse referentiefeed en veerkrachtige dagelijkse terugvalopties.Converters
- Uurtariefcalculator voor FreelancersHet uur- en dagtarief dat het inkomen dat je wilt, de belasting, je bedrijfskosten en de uren die je echt kunt factureren dekt.Financieel
- Break-even-ROAS-calculatorHet rendement op advertentie-uitgaven vanaf waar een bestelling geen geld meer kost, het meeste dat een verkoop aan advertenties mag kosten en de ROAS die je doelmarge nodig heeft.Financieel
- ROI-calculatorReturn on investment als percentage en absolute winst of verlies.Financieel
- PercentagecalculatorDrie percentagevragen in één tool: P% van X, X is welk % van Y, X is P% van wat.Wiskunde