Comparador de Preços de API de IA
Compare os custos de OpenAI, Anthropic, Google, DeepSeek e mais 10 provedores — 20 modelos ordenados do mais barato ao mais caro. Informe seus tokens mensais e descubra instantaneamente o custo mensal e anual de cada API.
Calculadora gratuita de custos de API LLM
Os preços dos modelos são expressos em USD por milhão de tokens, um formato universal. A calculadora interativa está em inglês, mas funciona para qualquer carga de trabalho: basta informar seus números e comparar os resultados.
Abrir calculadoraComo a calculadora funciona
Custo mensal = (tokens de entrada ÷ 1M × preço de entrada) + (tokens de saída ÷ 1M × preço de saída). O custo anual é o valor mensal × 12.
Informe seu uso de tokens
Ajuste seus tokens mensais estimados de entrada e saída com os controles, ou digite valores exatos. O padrão começa em 1M de entrada e 500K de saída.
Escolha uma carga de trabalho
Selecione Chat, Código, Visão ou Raciocínio. A recomendação de melhor custo-benefício é filtrada para os modelos que realmente suportam essa capacidade.
Compare cada modelo
Veja o custo mensal e anual de cada modelo ordenado do mais barato ao mais caro, com o melhor custo-benefício destacado para sua carga.
Perguntas frequentes
Como é calculado o custo mensal de uma API LLM?
Custo mensal = (tokens de entrada ÷ 1.000.000) × preço de entrada + (tokens de saída ÷ 1.000.000) × preço de saída. A calculadora multiplica seus tokens mensais estimados pela tarifa de cada modelo e depois anualiza o resultado multiplicando por 12.
Qual é a API LLM mais barata?
Depende da sua carga de trabalho e da proporção de tokens. Modelos econômicos como Gemini 2.0 Flash, Mistral Small e Amazon Nova Lite oferecem as menores tarifas por milhão de tokens, enquanto modelos de raciocínio custam bem mais. Informe seus volumes reais para ver a opção mais barata para o seu uso específico.
Por que tokens de entrada e de saída têm preços diferentes?
Os tokens de saída são gerados um a um durante a decodificação, o que consome mais processamento do que ler o prompt de entrada. Por isso o preço de saída costuma ser de 2 a 5 vezes maior que o de entrada no mesmo modelo. Uma carga que gera muita saída é muito sensível à tarifa de saída.
Como funciona a recomendação de melhor custo-benefício?
Para a carga de trabalho selecionada (Chat, Código, Visão ou Raciocínio), a calculadora filtra os modelos que suportam essa capacidade e destaca o de menor custo mensal. Se nenhum modelo declarar essa capacidade, ela usa o modelo mais barato no geral.
Esses preços são exatos?
Todas as cifras são estimativas compiladas de tarifas públicas e podem estar atrás das tarifas oficiais. Use-as para planejamento e comparação e confirme na página de preços do provedor antes de se comprometer.
A calculadora inclui prompt caching e descontos em lote?
Sim. Ative o “Prompt caching” para aplicar tarifas de entrada em cache (10–50 % da tarifa padrão em OpenAI, Anthropic e Google), ou “Batch API” para aplicar descontos de 50 % em troca de entrega em 24 horas. A tabela e a recomendação de melhor custo-benefício são recalculadas instantaneamente.