CALCOLATORE · Finanza
Calcolatore dei Costi delle API di IA
Quanto costa al mese il tuo carico di lavoro su ogni grande modello linguistico, con prezzi letti in tempo reale da un listino aperto.
Mostra la formula
Metodo verificato:Prezzi di listino per token, con fasce per contesto lungo e prezzi di lettura dalla cache dove indicati, letti in tempo reale dal listino aperto di LiteLLM · verificato a ottobre 2026
Dati
0,05 USD per 1 M di token in ingresso · 0,40 USD per 1 M di token in uscita
Chiamate all’API in un mese: 1.000 al giorno sono circa 30.000.
L’ingresso è tutto ciò che invii: prompt di sistema, cronologia, documenti e domanda. L’uscita include i token di ragionamento. 1.000 token sono circa 750 parole inglesi.
La parte di ogni prompt che si ripete identica — un prompt di sistema fisso o un documento — e che il fornitore legge dalla cache a un prezzo inferiore.
Prezzi per 1 M di token
Inserisci richieste e token per calcolare un carico di lavoro. Nel frattempo, ecco il prezzo di listino di ogni modello.
Dollari USA per milione di token
| Modello | Ingresso / 1 M | Cache / 1 M | Uscita / 1 M |
|---|---|---|---|
| gpt-5-nanoOpenAI | 0,05 USD | 0,005 USD | 0,40 USD |
| gpt-6-lunaOpenAI | 0,10 USD | 0,01 USD | 0,50 USD |
| gpt-4o-miniOpenAI | 0,15 USD | 0,075 USD | 0,60 USD |
| gpt-5.6-lunaOpenAI | 0,20 USD | 0,02 USD | 1,20 USD |
| gpt-5.4-nanoOpenAI | 0,20 USD | 0,02 USD | 1,25 USD |
| gpt-5-miniOpenAI | 0,25 USD | 0,025 USD | 2,00 USD |
| gpt-4.1-miniOpenAI | 0,40 USD | 0,10 USD | 1,60 USD |
| gpt-5.4-miniOpenAI | 0,75 USD | 0,075 USD | 4,50 USD |
| gpt-5OpenAI | 1,25 USD | 0,125 USD | 10,00 USD |
| gpt-5.1OpenAI | 1,25 USD | 0,125 USD | 10,00 USD |
| gpt-5.2OpenAI | 1,75 USD | 0,175 USD | 14,00 USD |
| gpt-5.3-codexOpenAI | 1,75 USD | 0,175 USD | 14,00 USD |
È mostrato il listino del 2 ott 2026. Il browser cerca prezzi più recenti all’apertura della pagina.
Fonte: il listino aperto di LiteLLM, aggiornato in base alla pagina dei prezzi di ciascun fornitore. Verifica i prezzi ufficiali di OpenAI
Prezzi di listino standard in dollari USA, tasse escluse. Endpoint batch, prioritari e regionali, scrittura in cache, strumenti e immagini si pagano a parte.
Come funziona
- Scegli un modello. I prezzi si caricano in tempo reale dal listino aperto di LiteLLM all’apertura della pagina, e il riquadro sotto il risultato indica quando sono stati verificati.
- Inserisci le richieste al mese, i token medi in ingresso e in uscita per richiesta e la quota d’ingresso servita dalla cache dei prompt.
- Leggi il costo mensile e annuale, la ripartizione tra ingresso e uscita e lo stesso carico calcolato su tutti gli altri modelli.
Domande frequenti
Quanti token ha una parola?
In inglese circa tre quarti di parola per token, quindi 1.000 token sono più o meno 750 parole. Altre lingue, il codice e i numeri usano più token per parola, e ogni famiglia di modelli ha il suo tokenizer; i dati d’uso nelle risposte dell’API ti danno i conteggi esatti.
Perché i token in uscita costano più di quelli in ingresso?
L’uscita viene generata un token alla volta, mentre l’intero ingresso si legge in un solo passaggio: per questo i fornitori fanno pagare l’uscita diverse volte il prezzo dell’ingresso. I modelli di ragionamento fatturano come uscita anche il ragionamento nascosto, ed è per questo che un ragionamento lungo fa salire il conto.
Che cos’è la cache dei prompt?
Quando l’inizio di un prompt si ripete identico tra le richieste — un lungo prompt di sistema o un documento —, i fornitori lo servono da una cache e fanno pagare solo una frazione del prezzo d’ingresso. Inserisci la quota d’ingresso che si ripete per vedere il risparmio; la prima richiesta, che scrive la cache, può costare un po’ di più, e questa pagina non la conta.
Da dove vengono i prezzi e quanto sono aggiornati?
Dal listino aperto di LiteLLM, che i manutentori allineano alla pagina dei prezzi di ciascun fornitore, di solito pochi giorni dopo una modifica. La pagina lo legge in tempo reale nel tuo browser e mostra quando l’ha verificato; se il listino non è raggiungibile, mostra la copia salvata con la sua data. Conferma sulla pagina del fornitore prima di impegnare un budget.
Esempi
- Un modello a 1 $ per milione di token in ingresso e 4 $ per milione in uscita: 10.000 richieste al mese da 2.000 token in ingresso e 500 in uscita
- 0,004 $ a richiesta: 40 $ al mese e 480 $ all’anno, metà per l’ingresso e metà per l’uscita.
- Lo stesso carico con metà di ogni prompt letta da una cache a 0,10 $ per milione
- 31 $ al mese: la metà dell’ingresso in cache costa 1 $ invece di 10 $.
Calcolatori correlati
- Convertitore di valuteConverti le valute supportate con un riferimento orario gratuito e fallback giornalieri affidabili.Convertitori
- Calcolatore Tariffa Oraria FreelanceLa tariffa oraria e giornaliera che copre il reddito che vuoi, le tasse, i costi dell’attività e le ore che puoi davvero fatturare.Finanza
- Calcolatore del ROAS di PareggioIl ritorno sulla spesa pubblicitaria oltre il quale un ordine smette di perdere soldi, il costo massimo in annunci per vendita e il ROAS che serve al tuo margine obiettivo.Finanza
- Calcolatore di ROIRitorno sull'investimento in percentuale e guadagno o perdita assoluti.Finanza
- Calcolatore di percentualiTre domande sulle percentuali in un solo strumento: l'X% di X, X è quanto % di Y, X è l'Y% di quanto.Matematica