CALCULATRICE · Finances
Calculateur de Coût d’API d’IA
Ce que coûte votre charge de travail chaque mois sur chaque grand modèle de langage, avec des prix lus en direct dans une liste de prix ouverte.
Afficher la formule
Méthode vérifiée:Prix catalogue par token, avec les paliers de contexte long et les prix de lecture en cache lorsqu’ils sont publiés, lus en direct dans la liste ouverte de LiteLLM · vérifié en octobre 2026
Données
0,05 $US par million de tokens d’entrée · 0,40 $US par million de tokens de sortie
Appels à l’API sur un mois : 1 000 par jour font environ 30 000.
L’entrée, c’est tout ce qui est envoyé : prompt système, historique, documents et question. La sortie inclut les tokens de raisonnement. 1 000 tokens font environ 750 mots anglais.
La partie de chaque prompt qui se répète à l’identique — un prompt système fixe ou un document — et que le fournisseur lit dans son cache à prix réduit.
Prix par million de tokens
Saisissez vos requêtes et vos tokens pour chiffrer une charge de travail. En attendant, voici le prix catalogue de chaque modèle.
Dollars américains par million de tokens
| Modèle | Entrée / 1 M | Cache / 1 M | Sortie / 1 M |
|---|---|---|---|
| gpt-5-nanoOpenAI | 0,05 $US | 0,005 $US | 0,40 $US |
| gpt-6-lunaOpenAI | 0,10 $US | 0,01 $US | 0,50 $US |
| gpt-4o-miniOpenAI | 0,15 $US | 0,075 $US | 0,60 $US |
| gpt-5.6-lunaOpenAI | 0,20 $US | 0,02 $US | 1,20 $US |
| gpt-5.4-nanoOpenAI | 0,20 $US | 0,02 $US | 1,25 $US |
| gpt-5-miniOpenAI | 0,25 $US | 0,025 $US | 2,00 $US |
| gpt-4.1-miniOpenAI | 0,40 $US | 0,10 $US | 1,60 $US |
| gpt-5.4-miniOpenAI | 0,75 $US | 0,075 $US | 4,50 $US |
| gpt-5OpenAI | 1,25 $US | 0,125 $US | 10,00 $US |
| gpt-5.1OpenAI | 1,25 $US | 0,125 $US | 10,00 $US |
| gpt-5.2OpenAI | 1,75 $US | 0,175 $US | 14,00 $US |
| gpt-5.3-codexOpenAI | 1,75 $US | 0,175 $US | 14,00 $US |
Affichage de la liste du 2 oct. 2026. Votre navigateur cherche des prix plus récents à l’ouverture de la page.
Source : la liste de prix ouverte de LiteLLM, tenue à jour d’après la page tarifaire de chaque fournisseur. Voir les prix officiels de OpenAI
Prix catalogue standard en dollars américains, hors taxes. Les traitements par lots, prioritaires et régionaux, l’écriture en cache, les outils et les images sont facturés autrement.
Comment ça marche
- Choisissez un modèle. Les prix sont chargés en direct depuis la liste ouverte de LiteLLM à l’ouverture de la page, et l’encadré sous le résultat indique quand ils ont été vérifiés.
- Saisissez les requêtes par mois, les tokens moyens d’entrée et de sortie par requête et la part de l’entrée servie par votre cache de prompts.
- Lisez le coût mensuel et annuel, la répartition entre entrée et sortie, et la même charge chiffrée sur tous les autres modèles.
Questions fréquentes
Combien de tokens fait un mot ?
En anglais, environ trois quarts de mot par token : 1 000 tokens font à peu près 750 mots. Les autres langues, le code et les nombres utilisent plus de tokens par mot, et chaque famille de modèles a son propre tokenizer ; les chiffres d’usage renvoyés par l’API donnent vos comptes exacts.
Pourquoi les tokens de sortie coûtent-ils plus cher que ceux d’entrée ?
La sortie est générée token par token alors que toute l’entrée est lue d’un coup ; les fournisseurs facturent donc la sortie plusieurs fois le prix de l’entrée. Les modèles de raisonnement facturent aussi leur raisonnement caché comme de la sortie, ce qui explique qu’un long raisonnement alourdisse la facture.
Qu’est-ce que la mise en cache des prompts ?
Quand le début d’un prompt se répète à l’identique d’une requête à l’autre — un long prompt système ou un document —, les fournisseurs le servent depuis un cache et n’en facturent qu’une fraction du prix d’entrée. Saisissez la part d’entrée qui se répète pour voir l’économie ; la première requête, qui écrit le cache, peut coûter un peu plus, ce que cette page ne compte pas.
D’où viennent les prix et à quel point sont-ils à jour ?
De la liste de prix ouverte de LiteLLM, que ses mainteneurs alignent sur la page tarifaire de chaque fournisseur, généralement quelques jours après un changement. La page la lit en direct dans votre navigateur et indique quand elle l’a vérifiée ; si la liste est injoignable, elle affiche la copie enregistrée avec sa date. Confirmez sur la page du fournisseur avant d’engager un budget.
Exemples
- Un modèle à 1 $ le million de tokens d’entrée et 4 $ le million en sortie : 10 000 requêtes par mois de 2 000 tokens d’entrée et 500 de sortie
- 0,004 $ par requête : 40 $ par mois et 480 $ par an, moitié pour l’entrée, moitié pour la sortie.
- La même charge avec la moitié de chaque prompt lue dans un cache à 0,10 $ le million
- 31 $ par mois : la moitié mise en cache de l’entrée coûte 1 $ au lieu de 10 $.
Calculatrices associées
- Convertisseur de devisesConvertissez les devises prises en charge avec une référence horaire gratuite et des replis quotidiens fiables.Convertisseurs
- Calculateur de Taux Horaire FreelanceLe taux horaire et journalier qui couvre le revenu que vous visez, les impôts, les frais professionnels et les heures réellement facturables.Finances
- Calculateur de ROAS de RentabilitéLe retour sur dépenses publicitaires à partir duquel une commande cesse de perdre de l’argent, le coût publicitaire maximal d’une vente et le ROAS qu’exige votre marge cible.Finances
- Calculatrice de ROIRetour sur investissement en pourcentage et gain ou perte absolue.Finances
- Calculatrice de pourcentageTrois questions de pourcentage en un seul outil : P% de X, X correspond à combien % de Y, X est P% de quoi.Mathématiques