跳转到正文

计算器 · 财务

AI API 费用计算器

你的调用量在每个大语言模型上每月要花多少钱,价格实时读取自一份公开价目表。

查看公式
每月费用 = (输入 token × 输入单价 + 输出 token × 输出单价) ÷ 1,000,000 × 每月请求数

方法审核:按 token 计的标准价格,含长上下文分档和已公布的缓存读取价,实时读取自 LiteLLM 公开价目表 · 2026年10月复核

输入

每百万输入 token US$0.05 · 每百万输出 token US$0.40

一个月内的 API 调用次数:每天 1,000 次约为每月 30,000 次。

输入是发送的全部内容:系统提示词、对话历史、文档和问题;输出包括推理 token。1,000 个 token 约等于 750 个英文单词。

—

每次提示词中完全重复的部分——固定的系统提示词或文档——会从服务商的提示词缓存中以更低价格读取。

每百万 token 价格

输入请求数和 token 数即可估算用量费用。在此之前,这里列出每个模型的标价。

美元 / 百万 token

美元 / 百万 token
模型输入 / 百万缓存 / 百万输出 / 百万
gpt-5-nanoOpenAIUS$0.05US$0.005US$0.40
gpt-6-lunaOpenAIUS$0.10US$0.01US$0.50
gpt-4o-miniOpenAIUS$0.15US$0.075US$0.60
gpt-5.6-lunaOpenAIUS$0.20US$0.02US$1.20
gpt-5.4-nanoOpenAIUS$0.20US$0.02US$1.25
gpt-5-miniOpenAIUS$0.25US$0.025US$2.00
gpt-4.1-miniOpenAIUS$0.40US$0.10US$1.60
gpt-5.4-miniOpenAIUS$0.75US$0.075US$4.50
gpt-5OpenAIUS$1.25US$0.125US$10.00
gpt-5.1OpenAIUS$1.25US$0.125US$10.00
gpt-5.2OpenAIUS$1.75US$0.175US$14.00
gpt-5.3-codexOpenAIUS$1.75US$0.175US$14.00
已保存的价目表

当前显示 2026年10月2日 的价目表。打开页面时,浏览器会自动查找更新的价格。

来源: LiteLLM 公开价目表,依据各服务商的官方价格页面持续更新。 查看 OpenAI 官方价格

美元标准标价,不含税。批量、优先和区域端点、缓存写入、工具调用和图片另行计费。

使用方法

  1. 选择一个模型。打开页面时会从 LiteLLM 公开价目表实时加载价格,结果下方的框会显示核对时间。
  2. 输入每月请求数、每次请求的平均输入和输出 token 数,以及由提示词缓存提供的输入比例。
  3. 查看每月和每年的费用、输入与输出的占比,以及同一用量在其他所有模型上的价格。

常见问题

一个词是多少个 token?

英文中每个 token 大约相当于四分之三个词,所以 1,000 个 token 约等于 750 个英文单词。中文等其他语言、代码和数字的 token 消耗更多,而且每个模型家族都有自己的分词器;API 返回的用量数据会给出准确数字。

为什么输出 token 比输入 token 贵?

输出要逐个 token 生成,而输入可以一次性读完,所以服务商把输出定价为输入的数倍。推理模型还会把隐藏的推理过程按输出计费,这也是长时间推理会让账单变高的原因。

什么是提示词缓存?

当提示词的开头在多次请求之间完全重复——比如很长的系统提示词或一份文档——服务商会从缓存中读取,只按输入价格的一小部分收费。填入重复部分所占的比例即可看到节省多少;首次写入缓存的请求可能稍贵一些,本页没有计入。

价格从哪里来,有多新?

来自 LiteLLM 公开价目表,维护者会按各服务商的官方价格页面更新,通常在调价后几天内完成。页面在你的浏览器里实时读取,并显示最近一次核对的时间;如果无法访问价目表,则显示已保存的副本及其日期。确定预算前,请到服务商官方页面再确认一次。

示例

某模型每百万输入 token 1 美元、每百万输出 token 4 美元:每月 10,000 次请求,每次输入 2,000、输出 500 个 token
每次请求 0.004 美元:每月 40 美元,每年 480 美元,输入和输出各占一半。
同样用量,但每次提示词有一半从每百万 0.10 美元的缓存读取
每月 31 美元:缓存的那一半输入只需 1 美元,而不是 10 美元。