Ir al contenido

CALCULADORA · Finanzas

Calculadora de Coste de API de IA

Lo que cuesta tu carga de trabajo al mes en cada modelo de lenguaje, con precios leídos en directo de una lista de precios abierta.

Ver la fórmula
Coste mensual = (tokens de entrada × precio de entrada + tokens de salida × precio de salida) ÷ 1 000 000 × solicitudes al mes

Método revisado:Precios de lista por token, con tramos de contexto largo y precios de lectura de caché cuando se publican, leídos en directo de la lista abierta de LiteLLM · revisado en octubre de 2026

Datos

0,05 US$ por 1 M de tokens de entrada · 0,40 US$ por 1 M de tokens de salida

Llamadas a la API en un mes: 1000 al día son unas 30 000.

La entrada es todo lo que envías: instrucciones del sistema, historial, documentos y la pregunta. La salida incluye los tokens de razonamiento. 1000 tokens son unas 750 palabras en inglés.

—

La parte de cada prompt que se repite tal cual —unas instrucciones fijas o un documento— y que el proveedor lee de su caché a un precio menor.

Precios por 1 M de tokens

Introduce tus solicitudes y tokens para calcular una carga de trabajo. Mientras tanto, este es el precio de lista de cada modelo.

Dólares estadounidenses por millón de tokens

Dólares estadounidenses por millón de tokens
ModeloEntrada / 1 MCaché / 1 MSalida / 1 M
gpt-5-nanoOpenAI0,05 US$0,005 US$0,40 US$
gpt-6-lunaOpenAI0,10 US$0,01 US$0,50 US$
gpt-4o-miniOpenAI0,15 US$0,075 US$0,60 US$
gpt-5.6-lunaOpenAI0,20 US$0,02 US$1,20 US$
gpt-5.4-nanoOpenAI0,20 US$0,02 US$1,25 US$
gpt-5-miniOpenAI0,25 US$0,025 US$2,00 US$
gpt-4.1-miniOpenAI0,40 US$0,10 US$1,60 US$
gpt-5.4-miniOpenAI0,75 US$0,075 US$4,50 US$
gpt-5OpenAI1,25 US$0,125 US$10,00 US$
gpt-5.1OpenAI1,25 US$0,125 US$10,00 US$
gpt-5.2OpenAI1,75 US$0,175 US$14,00 US$
gpt-5.3-codexOpenAI1,75 US$0,175 US$14,00 US$
Lista de precios guardada

Se muestra la lista del 2 oct 2026. Tu navegador busca precios más recientes al abrir la página.

Fuente: la lista de precios abierta de LiteLLM, que se mantiene al día con la página de precios de cada proveedor. Consulta los precios oficiales de OpenAI

Precios de lista estándar en dólares estadounidenses, sin impuestos. Los endpoints por lotes, prioritarios y regionales, la escritura en caché, las herramientas y las imágenes se cobran aparte.

Cómo funciona

  1. Elige un modelo. Los precios se cargan en directo de la lista abierta de LiteLLM al abrir la página, y el recuadro bajo el resultado indica cuándo se comprobaron.
  2. Introduce las solicitudes al mes, los tokens medios de entrada y de salida por solicitud y la parte de la entrada que sirve tu caché de prompts.
  3. Lee el coste mensual y anual, el reparto entre entrada y salida y la misma carga calculada en todos los demás modelos.

Preguntas frecuentes

¿Cuántos tokens tiene una palabra?

En inglés, unas tres cuartas partes de palabra por token, así que 1000 tokens son unas 750 palabras. Otros idiomas, el código y los números usan más tokens por palabra, y cada familia de modelos tiene su propio tokenizador; las cifras de uso de las respuestas de la API te dan las cantidades exactas.

¿Por qué los tokens de salida cuestan más que los de entrada?

La salida se genera token a token, mientras que toda la entrada se lee de una vez, así que los proveedores cobran la salida a varias veces el precio de la entrada. Los modelos de razonamiento también facturan como salida su razonamiento oculto, y por eso un razonamiento largo encarece la factura.

¿Qué es la caché de prompts?

Cuando el principio de un prompt se repite exactamente entre solicitudes —unas instrucciones de sistema largas o un documento—, los proveedores lo sirven desde una caché y cobran una fracción del precio de entrada. Introduce la parte de la entrada que se repite para ver el ahorro; la primera solicitud, que escribe la caché, puede costar algo más, y esta página no lo incluye.

¿De dónde salen los precios y cuánto de actuales son?

De la lista de precios abierta de LiteLLM, que sus mantenedores ajustan a la página de precios de cada proveedor, normalmente pocos días después de un cambio. La página la lee en directo en tu navegador y muestra cuándo la comprobó por última vez; si no puede acceder, muestra la copia guardada con su fecha. Confirma en la página del propio proveedor antes de comprometer un presupuesto.

Ejemplos

Un modelo a 1 $ por millón de tokens de entrada y 4 $ por millón de salida: 10 000 solicitudes al mes de 2000 tokens de entrada y 500 de salida
0,004 $ por solicitud: 40 $ al mes y 480 $ al año, la mitad por la entrada y la mitad por la salida.
La misma carga con la mitad de cada prompt leída de una caché a 0,10 $ por millón
31 $ al mes: la mitad en caché de la entrada cuesta 1 $ en lugar de 10 $.