CALCULADORA · Finanças
Calculadora de Custo de API de IA
Quanto sua carga de trabalho custa por mês em cada grande modelo de linguagem, com preços lidos ao vivo de uma lista de preços aberta.
Ver a fórmula
Método revisado:Preços de tabela por token, com faixas de contexto longo e preços de leitura de cache quando publicados, lidos ao vivo da lista aberta do LiteLLM · revisado em outubro de 2026
Entradas
US$ 0,05 por 1 mi de tokens de entrada · US$ 0,40 por 1 mi de tokens de saída
Chamadas à API em um mês: 1.000 por dia dão cerca de 30.000.
A entrada é tudo o que é enviado: prompt de sistema, histórico, documentos e a pergunta. A saída inclui os tokens de raciocínio. 1.000 tokens são cerca de 750 palavras em inglês.
A parte de cada prompt que se repete igual — um prompt de sistema fixo ou um documento — e que o provedor lê do cache por um preço menor.
Preços por 1 mi de tokens
Informe requisições e tokens para calcular uma carga de trabalho. Enquanto isso, veja o preço de tabela de cada modelo.
Dólares americanos por milhão de tokens
| Modelo | Entrada / 1 mi | Cache / 1 mi | Saída / 1 mi |
|---|---|---|---|
| gpt-5-nanoOpenAI | US$ 0,05 | US$ 0,005 | US$ 0,40 |
| gpt-6-lunaOpenAI | US$ 0,10 | US$ 0,01 | US$ 0,50 |
| gpt-4o-miniOpenAI | US$ 0,15 | US$ 0,075 | US$ 0,60 |
| gpt-5.6-lunaOpenAI | US$ 0,20 | US$ 0,02 | US$ 1,20 |
| gpt-5.4-nanoOpenAI | US$ 0,20 | US$ 0,02 | US$ 1,25 |
| gpt-5-miniOpenAI | US$ 0,25 | US$ 0,025 | US$ 2,00 |
| gpt-4.1-miniOpenAI | US$ 0,40 | US$ 0,10 | US$ 1,60 |
| gpt-5.4-miniOpenAI | US$ 0,75 | US$ 0,075 | US$ 4,50 |
| gpt-5OpenAI | US$ 1,25 | US$ 0,125 | US$ 10,00 |
| gpt-5.1OpenAI | US$ 1,25 | US$ 0,125 | US$ 10,00 |
| gpt-5.2OpenAI | US$ 1,75 | US$ 0,175 | US$ 14,00 |
| gpt-5.3-codexOpenAI | US$ 1,75 | US$ 0,175 | US$ 14,00 |
Mostrando a lista de 2 de out. de 2026. Seu navegador procura preços mais recentes ao abrir a página.
Fonte: a lista de preços aberta do LiteLLM, mantida em dia com a página de preços de cada provedor. Confira os preços oficiais da OpenAI
Preços de tabela padrão em dólares americanos, sem impostos. Endpoints em lote, prioritários e regionais, gravação em cache, ferramentas e imagens são cobrados à parte.
Como funciona
- Escolha um modelo. Os preços carregam ao vivo da lista aberta do LiteLLM quando a página abre, e o quadro abaixo do resultado mostra quando foram conferidos.
- Informe as requisições por mês, os tokens médios de entrada e de saída por requisição e a parte da entrada servida pelo cache de prompts.
- Veja o custo mensal e anual, a divisão entre entrada e saída e a mesma carga calculada em todos os outros modelos.
Perguntas frequentes
Quantos tokens tem uma palavra?
Em inglês, cerca de três quartos de palavra por token, então 1.000 tokens são umas 750 palavras. Outros idiomas, como o português, além de código e números, usam mais tokens por palavra, e cada família de modelos tem seu próprio tokenizador; os números de uso nas respostas da API dão suas contagens exatas.
Por que os tokens de saída custam mais que os de entrada?
A saída é gerada um token por vez, enquanto toda a entrada é lida de uma só vez; por isso os provedores cobram pela saída várias vezes o preço da entrada. Modelos de raciocínio também cobram o raciocínio oculto como saída, e é por isso que um raciocínio longo encarece a conta.
O que é cache de prompts?
Quando o início de um prompt se repete exatamente entre requisições — um prompt de sistema longo ou um documento —, os provedores o servem de um cache e cobram uma fração do preço de entrada. Informe a parte da entrada que se repete para ver a economia; a primeira requisição, que grava o cache, pode custar um pouco mais, e esta página não conta isso.
De onde vêm os preços e quão atuais eles são?
Da lista de preços aberta do LiteLLM, que seus mantenedores ajustam à página de preços de cada provedor, em geral poucos dias depois de uma mudança. A página a lê ao vivo no seu navegador e mostra quando a conferiu; se a lista estiver fora do ar, mostra a cópia salva com a data. Confirme na página do próprio provedor antes de fechar um orçamento.
Exemplos
- Um modelo a US$ 1 por milhão de tokens de entrada e US$ 4 por milhão de saída: 10.000 requisições por mês de 2.000 tokens de entrada e 500 de saída
- US$ 0,004 por requisição: US$ 40 por mês e US$ 480 por ano, metade pela entrada e metade pela saída.
- A mesma carga com metade de cada prompt lida de um cache a US$ 0,10 por milhão
- US$ 31 por mês: a metade da entrada em cache custa US$ 1 em vez de US$ 10.
Calculadoras relacionadas
- Conversor de MoedasConverta moedas mundiais suportadas com uma fonte de referência gratuita atualizada a cada hora e fontes de reserva diária.Conversores
- Calculadora de Valor da Hora FreelancerO valor por hora e por dia que cobre a renda que você quer, os impostos, os custos do negócio e as horas que dá para cobrar de fato.Finanças
- Calculadora de ROAS de EquilíbrioO retorno sobre o investimento em anúncios a partir do qual um pedido deixa de dar prejuízo, o máximo que uma venda pode custar em anúncios e o ROAS que sua margem-alvo exige.Finanças
- Calculadora de ROIRetorno sobre o investimento em porcentagem e ganho ou perda absolutos.Finanças
- Calculadora de PorcentagemTrês perguntas de porcentagem em uma ferramenta: P% de X, X é qual % de Y, X é P% de quê.Matemática