Aller au contenu

CALCULATRICE · Finances

Calculateur de Coût d’API d’IA

Ce que coûte votre charge de travail chaque mois sur chaque grand modèle de langage, avec des prix lus en direct dans une liste de prix ouverte.

Afficher la formule
Coût mensuel = (tokens d’entrée × prix d’entrée + tokens de sortie × prix de sortie) ÷ 1 000 000 × requêtes par mois

Méthode vérifiée:Prix catalogue par token, avec les paliers de contexte long et les prix de lecture en cache lorsqu’ils sont publiés, lus en direct dans la liste ouverte de LiteLLM · vérifié en octobre 2026

Données

0,05 $US par million de tokens d’entrée · 0,40 $US par million de tokens de sortie

Appels à l’API sur un mois : 1 000 par jour font environ 30 000.

L’entrée, c’est tout ce qui est envoyé : prompt système, historique, documents et question. La sortie inclut les tokens de raisonnement. 1 000 tokens font environ 750 mots anglais.

—

La partie de chaque prompt qui se répète à l’identique — un prompt système fixe ou un document — et que le fournisseur lit dans son cache à prix réduit.

Prix par million de tokens

Saisissez vos requêtes et vos tokens pour chiffrer une charge de travail. En attendant, voici le prix catalogue de chaque modèle.

Dollars américains par million de tokens

Dollars américains par million de tokens
ModèleEntrée / 1 MCache / 1 MSortie / 1 M
gpt-5-nanoOpenAI0,05 $US0,005 $US0,40 $US
gpt-6-lunaOpenAI0,10 $US0,01 $US0,50 $US
gpt-4o-miniOpenAI0,15 $US0,075 $US0,60 $US
gpt-5.6-lunaOpenAI0,20 $US0,02 $US1,20 $US
gpt-5.4-nanoOpenAI0,20 $US0,02 $US1,25 $US
gpt-5-miniOpenAI0,25 $US0,025 $US2,00 $US
gpt-4.1-miniOpenAI0,40 $US0,10 $US1,60 $US
gpt-5.4-miniOpenAI0,75 $US0,075 $US4,50 $US
gpt-5OpenAI1,25 $US0,125 $US10,00 $US
gpt-5.1OpenAI1,25 $US0,125 $US10,00 $US
gpt-5.2OpenAI1,75 $US0,175 $US14,00 $US
gpt-5.3-codexOpenAI1,75 $US0,175 $US14,00 $US
Liste de prix enregistrée

Affichage de la liste du 2 oct. 2026. Votre navigateur cherche des prix plus récents à l’ouverture de la page.

Source : la liste de prix ouverte de LiteLLM, tenue à jour d’après la page tarifaire de chaque fournisseur. Voir les prix officiels de OpenAI

Prix catalogue standard en dollars américains, hors taxes. Les traitements par lots, prioritaires et régionaux, l’écriture en cache, les outils et les images sont facturés autrement.

Comment ça marche

  1. Choisissez un modèle. Les prix sont chargés en direct depuis la liste ouverte de LiteLLM à l’ouverture de la page, et l’encadré sous le résultat indique quand ils ont été vérifiés.
  2. Saisissez les requêtes par mois, les tokens moyens d’entrée et de sortie par requête et la part de l’entrée servie par votre cache de prompts.
  3. Lisez le coût mensuel et annuel, la répartition entre entrée et sortie, et la même charge chiffrée sur tous les autres modèles.

Questions fréquentes

Combien de tokens fait un mot ?

En anglais, environ trois quarts de mot par token : 1 000 tokens font à peu près 750 mots. Les autres langues, le code et les nombres utilisent plus de tokens par mot, et chaque famille de modèles a son propre tokenizer ; les chiffres d’usage renvoyés par l’API donnent vos comptes exacts.

Pourquoi les tokens de sortie coûtent-ils plus cher que ceux d’entrée ?

La sortie est générée token par token alors que toute l’entrée est lue d’un coup ; les fournisseurs facturent donc la sortie plusieurs fois le prix de l’entrée. Les modèles de raisonnement facturent aussi leur raisonnement caché comme de la sortie, ce qui explique qu’un long raisonnement alourdisse la facture.

Qu’est-ce que la mise en cache des prompts ?

Quand le début d’un prompt se répète à l’identique d’une requête à l’autre — un long prompt système ou un document —, les fournisseurs le servent depuis un cache et n’en facturent qu’une fraction du prix d’entrée. Saisissez la part d’entrée qui se répète pour voir l’économie ; la première requête, qui écrit le cache, peut coûter un peu plus, ce que cette page ne compte pas.

D’où viennent les prix et à quel point sont-ils à jour ?

De la liste de prix ouverte de LiteLLM, que ses mainteneurs alignent sur la page tarifaire de chaque fournisseur, généralement quelques jours après un changement. La page la lit en direct dans votre navigateur et indique quand elle l’a vérifiée ; si la liste est injoignable, elle affiche la copie enregistrée avec sa date. Confirmez sur la page du fournisseur avant d’engager un budget.

Exemples

Un modèle à 1 $ le million de tokens d’entrée et 4 $ le million en sortie : 10 000 requêtes par mois de 2 000 tokens d’entrée et 500 de sortie
0,004 $ par requête : 40 $ par mois et 480 $ par an, moitié pour l’entrée, moitié pour la sortie.
La même charge avec la moitié de chaque prompt lue dans un cache à 0,10 $ le million
31 $ par mois : la moitié mise en cache de l’entrée coûte 1 $ au lieu de 10 $.