Pular para o conteúdo

CALCULADORA · Finanças

Calculadora de Custo de API de IA

Quanto sua carga de trabalho custa por mês em cada grande modelo de linguagem, com preços lidos ao vivo de uma lista de preços aberta.

Ver a fórmula
Custo mensal = (tokens de entrada × preço de entrada + tokens de saída × preço de saída) ÷ 1.000.000 × requisições por mês

Método revisado:Preços de tabela por token, com faixas de contexto longo e preços de leitura de cache quando publicados, lidos ao vivo da lista aberta do LiteLLM · revisado em outubro de 2026

Entradas

US$ 0,05 por 1 mi de tokens de entrada · US$ 0,40 por 1 mi de tokens de saída

Chamadas à API em um mês: 1.000 por dia dão cerca de 30.000.

A entrada é tudo o que é enviado: prompt de sistema, histórico, documentos e a pergunta. A saída inclui os tokens de raciocínio. 1.000 tokens são cerca de 750 palavras em inglês.

—

A parte de cada prompt que se repete igual — um prompt de sistema fixo ou um documento — e que o provedor lê do cache por um preço menor.

Preços por 1 mi de tokens

Informe requisições e tokens para calcular uma carga de trabalho. Enquanto isso, veja o preço de tabela de cada modelo.

Dólares americanos por milhão de tokens

Dólares americanos por milhão de tokens
ModeloEntrada / 1 miCache / 1 miSaída / 1 mi
gpt-5-nanoOpenAIUS$ 0,05US$ 0,005US$ 0,40
gpt-6-lunaOpenAIUS$ 0,10US$ 0,01US$ 0,50
gpt-4o-miniOpenAIUS$ 0,15US$ 0,075US$ 0,60
gpt-5.6-lunaOpenAIUS$ 0,20US$ 0,02US$ 1,20
gpt-5.4-nanoOpenAIUS$ 0,20US$ 0,02US$ 1,25
gpt-5-miniOpenAIUS$ 0,25US$ 0,025US$ 2,00
gpt-4.1-miniOpenAIUS$ 0,40US$ 0,10US$ 1,60
gpt-5.4-miniOpenAIUS$ 0,75US$ 0,075US$ 4,50
gpt-5OpenAIUS$ 1,25US$ 0,125US$ 10,00
gpt-5.1OpenAIUS$ 1,25US$ 0,125US$ 10,00
gpt-5.2OpenAIUS$ 1,75US$ 0,175US$ 14,00
gpt-5.3-codexOpenAIUS$ 1,75US$ 0,175US$ 14,00
Tabela de preços salva

Mostrando a lista de 2 de out. de 2026. Seu navegador procura preços mais recentes ao abrir a página.

Fonte: a lista de preços aberta do LiteLLM, mantida em dia com a página de preços de cada provedor. Confira os preços oficiais da OpenAI

Preços de tabela padrão em dólares americanos, sem impostos. Endpoints em lote, prioritários e regionais, gravação em cache, ferramentas e imagens são cobrados à parte.

Como funciona

  1. Escolha um modelo. Os preços carregam ao vivo da lista aberta do LiteLLM quando a página abre, e o quadro abaixo do resultado mostra quando foram conferidos.
  2. Informe as requisições por mês, os tokens médios de entrada e de saída por requisição e a parte da entrada servida pelo cache de prompts.
  3. Veja o custo mensal e anual, a divisão entre entrada e saída e a mesma carga calculada em todos os outros modelos.

Perguntas frequentes

Quantos tokens tem uma palavra?

Em inglês, cerca de três quartos de palavra por token, então 1.000 tokens são umas 750 palavras. Outros idiomas, como o português, além de código e números, usam mais tokens por palavra, e cada família de modelos tem seu próprio tokenizador; os números de uso nas respostas da API dão suas contagens exatas.

Por que os tokens de saída custam mais que os de entrada?

A saída é gerada um token por vez, enquanto toda a entrada é lida de uma só vez; por isso os provedores cobram pela saída várias vezes o preço da entrada. Modelos de raciocínio também cobram o raciocínio oculto como saída, e é por isso que um raciocínio longo encarece a conta.

O que é cache de prompts?

Quando o início de um prompt se repete exatamente entre requisições — um prompt de sistema longo ou um documento —, os provedores o servem de um cache e cobram uma fração do preço de entrada. Informe a parte da entrada que se repete para ver a economia; a primeira requisição, que grava o cache, pode custar um pouco mais, e esta página não conta isso.

De onde vêm os preços e quão atuais eles são?

Da lista de preços aberta do LiteLLM, que seus mantenedores ajustam à página de preços de cada provedor, em geral poucos dias depois de uma mudança. A página a lê ao vivo no seu navegador e mostra quando a conferiu; se a lista estiver fora do ar, mostra a cópia salva com a data. Confirme na página do próprio provedor antes de fechar um orçamento.

Exemplos

Um modelo a US$ 1 por milhão de tokens de entrada e US$ 4 por milhão de saída: 10.000 requisições por mês de 2.000 tokens de entrada e 500 de saída
US$ 0,004 por requisição: US$ 40 por mês e US$ 480 por ano, metade pela entrada e metade pela saída.
A mesma carga com metade de cada prompt lida de um cache a US$ 0,10 por milhão
US$ 31 por mês: a metade da entrada em cache custa US$ 1 em vez de US$ 10.