Comparador de Preços de API de IA

Compare os custos de OpenAI, Anthropic, Google, DeepSeek e mais 10 provedores — 20 modelos ordenados do mais barato ao mais caro. Informe seus tokens mensais e descubra instantaneamente o custo mensal e anual de cada API.

Calculadora gratuita de custos de API LLM

Os preços dos modelos são expressos em USD por milhão de tokens, um formato universal. A calculadora interativa está em inglês, mas funciona para qualquer carga de trabalho: basta informar seus números e comparar os resultados.

Abrir calculadora

Como a calculadora funciona

Custo mensal = (tokens de entrada ÷ 1M × preço de entrada) + (tokens de saída ÷ 1M × preço de saída). O custo anual é o valor mensal × 12.

1

Informe seu uso de tokens

Ajuste seus tokens mensais estimados de entrada e saída com os controles, ou digite valores exatos. O padrão começa em 1M de entrada e 500K de saída.

2

Escolha uma carga de trabalho

Selecione Chat, Código, Visão ou Raciocínio. A recomendação de melhor custo-benefício é filtrada para os modelos que realmente suportam essa capacidade.

3

Compare cada modelo

Veja o custo mensal e anual de cada modelo ordenado do mais barato ao mais caro, com o melhor custo-benefício destacado para sua carga.

Perguntas frequentes

Como é calculado o custo mensal de uma API LLM?

Custo mensal = (tokens de entrada ÷ 1.000.000) × preço de entrada + (tokens de saída ÷ 1.000.000) × preço de saída. A calculadora multiplica seus tokens mensais estimados pela tarifa de cada modelo e depois anualiza o resultado multiplicando por 12.

Qual é a API LLM mais barata?

Depende da sua carga de trabalho e da proporção de tokens. Modelos econômicos como Gemini 2.0 Flash, Mistral Small e Amazon Nova Lite oferecem as menores tarifas por milhão de tokens, enquanto modelos de raciocínio custam bem mais. Informe seus volumes reais para ver a opção mais barata para o seu uso específico.

Por que tokens de entrada e de saída têm preços diferentes?

Os tokens de saída são gerados um a um durante a decodificação, o que consome mais processamento do que ler o prompt de entrada. Por isso o preço de saída costuma ser de 2 a 5 vezes maior que o de entrada no mesmo modelo. Uma carga que gera muita saída é muito sensível à tarifa de saída.

Como funciona a recomendação de melhor custo-benefício?

Para a carga de trabalho selecionada (Chat, Código, Visão ou Raciocínio), a calculadora filtra os modelos que suportam essa capacidade e destaca o de menor custo mensal. Se nenhum modelo declarar essa capacidade, ela usa o modelo mais barato no geral.

Esses preços são exatos?

Todas as cifras são estimativas compiladas de tarifas públicas e podem estar atrás das tarifas oficiais. Use-as para planejamento e comparação e confirme na página de preços do provedor antes de se comprometer.

A calculadora inclui prompt caching e descontos em lote?

Sim. Ative o “Prompt caching” para aplicar tarifas de entrada em cache (10–50 % da tarifa padrão em OpenAI, Anthropic e Google), ou “Batch API” para aplicar descontos de 50 % em troca de entrega em 24 horas. A tabela e a recomendação de melhor custo-benefício são recalculadas instantaneamente.

Idiomas