Vai al contenuto

CALCOLATORE · Finanza

Calcolatore dei Costi delle API di IA

Quanto costa al mese il tuo carico di lavoro su ogni grande modello linguistico, con prezzi letti in tempo reale da un listino aperto.

Mostra la formula
Costo mensile = (token in ingresso × prezzo d’ingresso + token in uscita × prezzo d’uscita) ÷ 1.000.000 × richieste al mese

Metodo verificato:Prezzi di listino per token, con fasce per contesto lungo e prezzi di lettura dalla cache dove indicati, letti in tempo reale dal listino aperto di LiteLLM · verificato a ottobre 2026

Dati

0,05 USD per 1 M di token in ingresso · 0,40 USD per 1 M di token in uscita

Chiamate all’API in un mese: 1.000 al giorno sono circa 30.000.

L’ingresso è tutto ciò che invii: prompt di sistema, cronologia, documenti e domanda. L’uscita include i token di ragionamento. 1.000 token sono circa 750 parole inglesi.

—

La parte di ogni prompt che si ripete identica — un prompt di sistema fisso o un documento — e che il fornitore legge dalla cache a un prezzo inferiore.

Prezzi per 1 M di token

Inserisci richieste e token per calcolare un carico di lavoro. Nel frattempo, ecco il prezzo di listino di ogni modello.

Dollari USA per milione di token

Dollari USA per milione di token
ModelloIngresso / 1 MCache / 1 MUscita / 1 M
gpt-5-nanoOpenAI0,05 USD0,005 USD0,40 USD
gpt-6-lunaOpenAI0,10 USD0,01 USD0,50 USD
gpt-4o-miniOpenAI0,15 USD0,075 USD0,60 USD
gpt-5.6-lunaOpenAI0,20 USD0,02 USD1,20 USD
gpt-5.4-nanoOpenAI0,20 USD0,02 USD1,25 USD
gpt-5-miniOpenAI0,25 USD0,025 USD2,00 USD
gpt-4.1-miniOpenAI0,40 USD0,10 USD1,60 USD
gpt-5.4-miniOpenAI0,75 USD0,075 USD4,50 USD
gpt-5OpenAI1,25 USD0,125 USD10,00 USD
gpt-5.1OpenAI1,25 USD0,125 USD10,00 USD
gpt-5.2OpenAI1,75 USD0,175 USD14,00 USD
gpt-5.3-codexOpenAI1,75 USD0,175 USD14,00 USD
Listino salvato

È mostrato il listino del 2 ott 2026. Il browser cerca prezzi più recenti all’apertura della pagina.

Fonte: il listino aperto di LiteLLM, aggiornato in base alla pagina dei prezzi di ciascun fornitore. Verifica i prezzi ufficiali di OpenAI

Prezzi di listino standard in dollari USA, tasse escluse. Endpoint batch, prioritari e regionali, scrittura in cache, strumenti e immagini si pagano a parte.

Come funziona

  1. Scegli un modello. I prezzi si caricano in tempo reale dal listino aperto di LiteLLM all’apertura della pagina, e il riquadro sotto il risultato indica quando sono stati verificati.
  2. Inserisci le richieste al mese, i token medi in ingresso e in uscita per richiesta e la quota d’ingresso servita dalla cache dei prompt.
  3. Leggi il costo mensile e annuale, la ripartizione tra ingresso e uscita e lo stesso carico calcolato su tutti gli altri modelli.

Domande frequenti

Quanti token ha una parola?

In inglese circa tre quarti di parola per token, quindi 1.000 token sono più o meno 750 parole. Altre lingue, il codice e i numeri usano più token per parola, e ogni famiglia di modelli ha il suo tokenizer; i dati d’uso nelle risposte dell’API ti danno i conteggi esatti.

Perché i token in uscita costano più di quelli in ingresso?

L’uscita viene generata un token alla volta, mentre l’intero ingresso si legge in un solo passaggio: per questo i fornitori fanno pagare l’uscita diverse volte il prezzo dell’ingresso. I modelli di ragionamento fatturano come uscita anche il ragionamento nascosto, ed è per questo che un ragionamento lungo fa salire il conto.

Che cos’è la cache dei prompt?

Quando l’inizio di un prompt si ripete identico tra le richieste — un lungo prompt di sistema o un documento —, i fornitori lo servono da una cache e fanno pagare solo una frazione del prezzo d’ingresso. Inserisci la quota d’ingresso che si ripete per vedere il risparmio; la prima richiesta, che scrive la cache, può costare un po’ di più, e questa pagina non la conta.

Da dove vengono i prezzi e quanto sono aggiornati?

Dal listino aperto di LiteLLM, che i manutentori allineano alla pagina dei prezzi di ciascun fornitore, di solito pochi giorni dopo una modifica. La pagina lo legge in tempo reale nel tuo browser e mostra quando l’ha verificato; se il listino non è raggiungibile, mostra la copia salvata con la sua data. Conferma sulla pagina del fornitore prima di impegnare un budget.

Esempi

Un modello a 1 $ per milione di token in ingresso e 4 $ per milione in uscita: 10.000 richieste al mese da 2.000 token in ingresso e 500 in uscita
0,004 $ a richiesta: 40 $ al mese e 480 $ all’anno, metà per l’ingresso e metà per l’uscita.
Lo stesso carico con metà di ogni prompt letta da una cache a 0,10 $ per milione
31 $ al mese: la metà dell’ingresso in cache costa 1 $ invece di 10 $.