計算機 · 金融
AI API料金計算機
あなたの利用量が大規模言語モデルごとに月いくらになるかを、公開価格リストからリアルタイムで読み込んだ料金で計算します。
数式を表示
計算方法の確認:トークンあたりの標準定価(長文コンテキスト料金とキャッシュ読み取り料金は掲載がある場合)、LiteLLMの公開価格リストからリアルタイムで取得 · 2026年10月確認
入力
入力100万トークンあたり $0.05 · 出力100万トークンあたり $0.40
1か月のAPI呼び出し回数:1日1,000回なら約30,000回です。
入力は送信するすべて(システムプロンプト、会話履歴、資料、質問)。出力には推論トークンも含まれます。1,000トークンは英語で約750語です。
毎回まったく同じ部分(固定のシステムプロンプトや資料)は、プロバイダーのプロンプトキャッシュから安い料金で読み込まれます。
100万トークンあたりの料金
リクエスト数とトークン数を入れると利用量の費用を計算します。それまでは各モデルの定価を一覧で表示します。
100万トークンあたりの米ドル
| モデル | 入力 / 100万 | キャッシュ / 100万 | 出力 / 100万 |
|---|---|---|---|
| gpt-5-nanoOpenAI | $0.05 | $0.005 | $0.40 |
| gpt-6-lunaOpenAI | $0.10 | $0.01 | $0.50 |
| gpt-4o-miniOpenAI | $0.15 | $0.075 | $0.60 |
| gpt-5.6-lunaOpenAI | $0.20 | $0.02 | $1.20 |
| gpt-5.4-nanoOpenAI | $0.20 | $0.02 | $1.25 |
| gpt-5-miniOpenAI | $0.25 | $0.025 | $2.00 |
| gpt-4.1-miniOpenAI | $0.40 | $0.10 | $1.60 |
| gpt-5.4-miniOpenAI | $0.75 | $0.075 | $4.50 |
| gpt-5OpenAI | $1.25 | $0.125 | $10.00 |
| gpt-5.1OpenAI | $1.25 | $0.125 | $10.00 |
| gpt-5.2OpenAI | $1.75 | $0.175 | $14.00 |
| gpt-5.3-codexOpenAI | $1.75 | $0.175 | $14.00 |
2026/10/02 のリストを表示しています。ページを開くと、ブラウザが新しい価格を確認します。
出典: LiteLLM の公開価格リスト(各プロバイダーの公式料金ページに合わせて更新)。 OpenAI の公式料金を確認
米ドル建ての標準定価(税抜)です。バッチ・優先・リージョン別エンドポイント、キャッシュ書き込み、ツール、画像は別料金です。
使い方
- モデルを選びます。ページを開くとLiteLLMの公開価格リストから料金がリアルタイムで読み込まれ、結果の下の枠に確認日時が表示されます。
- 月間リクエスト数、1回あたりの平均入力・出力トークン数、プロンプトキャッシュから読まれる入力の割合を入力します。
- 月額・年額の費用、入力と出力の内訳、同じ利用量をほかの全モデルで計算した金額を確認します。
よくある質問
1単語は何トークン?
英語ではおよそ1トークンが0.75語なので、1,000トークンは約750語です。日本語などほかの言語やコード、数字は1語あたりのトークンが多く、モデルごとにトークナイザーも違います。APIの応答に含まれる使用量の数字で正確な値が分かります。
出力トークンが入力より高いのはなぜ?
出力は1トークンずつ生成するのに対し、入力は一度にまとめて読めるため、プロバイダーは出力を入力の数倍の単価にしています。推論モデルは見えない推論部分も出力として課金するので、長く推論するほど請求額が増えます。
プロンプトキャッシュとは?
長いシステムプロンプトや資料など、プロンプトの先頭部分がリクエスト間でまったく同じなら、プロバイダーはキャッシュから読み出し、入力単価のごく一部だけを請求します。繰り返す入力の割合を入れると節約額が分かります。最初にキャッシュへ書き込むリクエストは少し高くなることがありますが、このページでは含めていません。
価格の出所と新しさは?
LiteLLMの公開価格リストです。メンテナーが各プロバイダーの公式料金ページに合わせて更新しており、改定から数日以内に反映されるのが普通です。ページはブラウザ内でリアルタイムに読み込み、最終確認日時を表示します。リストに接続できない場合は保存済みのコピーを日付付きで表示します。予算を決める前に、プロバイダーの公式ページでも確認してください。
計算例
- 入力100万トークンあたり1ドル、出力100万トークンあたり4ドルのモデルで、入力2,000・出力500トークンのリクエストを月10,000回
- 1リクエスト0.004ドル:月40ドル、年480ドルで、入力と出力が半分ずつです。
- 同じ利用量で、各プロンプトの半分を100万トークンあたり0.10ドルのキャッシュから読む場合
- 月31ドル:キャッシュされた入力の半分は10ドルではなく1ドルになります。