Przejdź do treści

KALKULATOR · Finanse

Kalkulator Kosztów API AI

Ile kosztuje miesięcznie Twoje obciążenie na każdym dużym modelu językowym, z cenami pobieranymi na bieżąco z otwartego cennika.

Pokaż wzór
Koszt miesięczny = (tokeny wejściowe × cena wejścia + tokeny wyjściowe × cena wyjścia) ÷ 1 000 000 × zapytania miesięcznie

Metoda zweryfikowana:Ceny katalogowe za token, z progami długiego kontekstu i cenami odczytu z cache tam, gdzie je podano, pobierane na bieżąco z otwartego cennika LiteLLM · sprawdzono w październiku 2026

Dane wejściowe

0,05 USD za 1 mln tokenów wejściowych · 0,40 USD za 1 mln tokenów wyjściowych

Wywołania API w miesiącu: 1000 dziennie to około 30 000.

Wejście to wszystko, co wysyłasz: prompt systemowy, historia rozmowy, dokumenty i pytanie. Wyjście obejmuje tokeny rozumowania. 1000 tokenów to około 750 angielskich słów.

—

Część każdego promptu, która powtarza się dokładnie — stały prompt systemowy lub dokument — i którą dostawca odczytuje taniej ze swojej pamięci podręcznej.

Ceny za 1 mln tokenów

Wpisz zapytania i tokeny, aby wycenić obciążenie. Do tego czasu widzisz tu cenę katalogową każdego modelu.

Dolary amerykańskie za milion tokenów

Dolary amerykańskie za milion tokenów
ModelWejście / 1 mlnCache / 1 mlnWyjście / 1 mln
gpt-5-nanoOpenAI0,05 USD0,005 USD0,40 USD
gpt-6-lunaOpenAI0,10 USD0,01 USD0,50 USD
gpt-4o-miniOpenAI0,15 USD0,075 USD0,60 USD
gpt-5.6-lunaOpenAI0,20 USD0,02 USD1,20 USD
gpt-5.4-nanoOpenAI0,20 USD0,02 USD1,25 USD
gpt-5-miniOpenAI0,25 USD0,025 USD2,00 USD
gpt-4.1-miniOpenAI0,40 USD0,10 USD1,60 USD
gpt-5.4-miniOpenAI0,75 USD0,075 USD4,50 USD
gpt-5OpenAI1,25 USD0,125 USD10,00 USD
gpt-5.1OpenAI1,25 USD0,125 USD10,00 USD
gpt-5.2OpenAI1,75 USD0,175 USD14,00 USD
gpt-5.3-codexOpenAI1,75 USD0,175 USD14,00 USD
Zapisany cennik

Widzisz cennik z 2 paź 2026. Przeglądarka szuka nowszych cen po otwarciu strony.

Źródło: otwarty cennik LiteLLM, aktualizowany na podstawie stron cenowych poszczególnych dostawców. Sprawdź oficjalne ceny OpenAI

Standardowe ceny katalogowe w dolarach amerykańskich, bez podatku. Przetwarzanie wsadowe, priorytetowe i regionalne, zapis do cache, narzędzia i obrazy są rozliczane inaczej.

Jak to działa

  1. Wybierz model. Ceny wczytują się na bieżąco z otwartego cennika LiteLLM po otwarciu strony, a ramka pod wynikiem pokazuje, kiedy je sprawdzono.
  2. Wpisz liczbę zapytań miesięcznie, średnią liczbę tokenów wejściowych i wyjściowych na zapytanie oraz część wejścia obsługiwaną z pamięci podręcznej.
  3. Odczytaj koszt miesięczny i roczny, podział na wejście i wyjście oraz to samo obciążenie wycenione na każdym innym modelu.

Najczęściej zadawane pytania

Ile tokenów ma jedno słowo?

Po angielsku mniej więcej trzy czwarte słowa na token, więc 1000 tokenów to około 750 słów. Inne języki, w tym polski, a także kod i liczby zużywają więcej tokenów na słowo, a każda rodzina modeli ma własny tokenizer; dane o użyciu w odpowiedziach API podają dokładne liczby.

Dlaczego tokeny wyjściowe kosztują więcej niż wejściowe?

Wyjście powstaje token po tokenie, a całe wejście jest czytane za jednym razem, dlatego dostawcy liczą za wyjście kilka razy więcej niż za wejście. Modele rozumujące rozliczają też ukryte rozumowanie jako wyjście, dlatego długie rozumowanie podnosi rachunek.

Czym jest pamięć podręczna promptów?

Gdy początek promptu powtarza się dokładnie między zapytaniami — długi prompt systemowy albo dokument — dostawcy podają go z pamięci podręcznej i liczą tylko ułamek ceny wejścia. Wpisz część wejścia, która się powtarza, by zobaczyć oszczędność; pierwsze zapytanie, które zapisuje cache, może kosztować nieco więcej, czego ta strona nie uwzględnia.

Skąd pochodzą ceny i jak są aktualne?

Z otwartego cennika LiteLLM, który jego opiekunowie dopasowują do strony cenowej każdego dostawcy, zwykle w ciągu kilku dni od zmiany. Strona czyta go na bieżąco w Twojej przeglądarce i pokazuje, kiedy ostatnio sprawdzała; gdy cennik jest niedostępny, pokazuje zapisaną kopię z datą. Przed ustaleniem budżetu sprawdź stronę samego dostawcy.

Przykłady

Model za 1 USD za milion tokenów wejściowych i 4 USD za milion wyjściowych: 10 000 zapytań miesięcznie po 2000 tokenów wejściowych i 500 wyjściowych
0,004 USD za zapytanie: 40 USD miesięcznie i 480 USD rocznie, po połowie za wejście i wyjście.
To samo obciążenie, gdy połowa każdego promptu pochodzi z cache po 0,10 USD za milion
31 USD miesięcznie: połowa wejścia z cache kosztuje 1 USD zamiast 10 USD.