Comparador de Precios de API de IA

Compara los costos de OpenAI, Anthropic, Google, DeepSeek y 10 proveedores más — 20 modelos ordenados del más barato al más caro. Introduce tus tokens mensuales y descubre al instante el costo mensual y anual de cada API.

Calculadora gratuita de costos de API LLM

Los precios de los modelos se expresan en USD por millón de tokens, un formato universal. La calculadora interactiva está en inglés, pero funciona para cualquier carga de trabajo: solo introduce tus números y compara los resultados.

Launch Calculator

Cómo funciona la calculadora

Costo mensual = (tokens de entrada ÷ 1M × precio de entrada) + (tokens de salida ÷ 1M × precio de salida). El costo anual es la cifra mensual × 12.

1

Introduce tu uso de tokens

Ajusta tus tokens mensuales estimados de entrada y salida con los controles, o escribe cifras exactas. Por defecto empieza en 1M de entrada y 500K de salida.

2

Elige una carga de trabajo

Selecciona Chat, Código, Visión o Razonamiento. La recomendación de mejor valor se filtra a los modelos que realmente soportan esa capacidad.

3

Compara cada modelo

Consulta el costo mensual y anual de cada modelo ordenado del más barato al más caro, con el mejor valor destacado para tu carga.

Preguntas frecuentes

¿Cómo se calcula el costo mensual de una API LLM?

Costo mensual = (tokens de entrada ÷ 1.000.000) × precio de entrada + (tokens de salida ÷ 1.000.000) × precio de salida. La calculadora multiplica tus tokens mensuales estimados por la tarifa de cada modelo y luego anualiza el resultado multiplicando por 12.

¿Cuál es la API LLM más barata?

Depende de tu carga de trabajo y de la proporción de tokens. Modelos económicos como Gemini 2.0 Flash, Mistral Small y Amazon Nova Lite ofrecen las tarifas más bajas por millón de tokens, mientras que los modelos de razonamiento cuestan mucho más. Introduce tus volúmenes reales para ver la opción más barata para tu uso específico.

¿Por qué los tokens de entrada y de salida tienen precios diferentes?

Los tokens de salida se generan uno a uno durante el decodificado, lo que consume más cómputo que leer el prompt de entrada. Por eso el precio de salida suele ser de 2 a 5 veces mayor que el de entrada en el mismo modelo. Una carga que genera mucha salida es muy sensible a la tarifa de salida.

¿Cómo funciona la recomendación de mejor valor?

Para la carga de trabajo seleccionada (Chat, Código, Visión o Razonamiento), la calculadora filtra los modelos que soportan esa capacidad y destaca el de menor costo mensual. Si ningún modelo declara esa capacidad, se usa el modelo más barato en general.

¿Estos precios son exactos?

Todas las cifras son estimaciones recopiladas de tarifas públicas y pueden ir por detrás de las tarifas oficiales. Úsalas para planificación y comparación, y confirma en la página de precios del proveedor antes de comprometerte.

¿La calculadora incluye prompt caching y descuentos por lote?

Sí. Activa “Prompt caching” para aplicar tarifas de entrada cacheada (10–50 % de la tarifa estándar en OpenAI, Anthropic y Google), o “Batch API” para aplicar descuentos del 50 % a cambio de una entrega en 24 horas. La tabla y la recomendación de mejor valor se recalculan al instante.

Idiomas