Calculadora de custo de API de IA

Estime o custo mensal de uma API de IA a partir de tokens de entrada e saída, volume de chamadas e cotação do dólar.

Publicado em

Esta calculadora estima quanto custa por mês rodar um fluxo em uma API de inteligência artificial. Você informa quantos tokens entram e saem em cada chamada, quantas chamadas acontecem no mês e a cotação do dólar; ela devolve o custo por chamada, o custo mensal e anual em dólar e em real, e mostra qual parte da conta vem da resposta do modelo. O cálculo roda no navegador.

Listamos apenas os preços que conseguimos conferir na página oficial do fornecedor, atualizados em 6 de setembro de 2026 (fonte). Para qualquer outro modelo, escolha "Outro modelo" e copie os dois valores da página de preços do seu fornecedor.

Prompt, instruções e o texto que você envia. Um token equivale a mais ou menos 4 caracteres em português.

O que o modelo devolve. Se ele raciocina antes de responder, isso também conta como saída.

Quantas vezes o fluxo roda no mês inteiro.

%

Parte do prompt que se repete e pode ser cacheada. A leitura de cache costuma custar 10% do preço cheio.

Use a cotação do dia da sua fatura; o câmbio muda o resultado tanto quanto o modelo.

Custo mensal

US$ 120,00

R$ 648,00

Custo por chamada

US$ 0,04

R$ 0,22

Custo anual

US$ 1.440,00

R$ 7.776,00

Tokens no mês

14.400.000

12.000.000 de entrada + 2.400.000 de saída

Parcela da saída no custo

50%

Quando passa de 60%, encurtar a resposta economiza mais que encurtar o prompt

Economia com cache

US$ 0,00

Por mês, em relação a pagar a entrada inteira

Estimativa, não fatura. O consumo real varia com o tamanho de cada pedido, com repetições e com erros que fazem a chamada rodar de novo. Some uma folga de 20% a 30% antes de prometer um custo a um cliente.

O que é um token, na prática

Modelos de linguagem cobram por token, não por palavra. Um token é um pedaço de texto de mais ou menos quatro caracteres em português — uma palavra curta costuma ser um token, uma palavra longa ou com acento pode ser dois ou três. Uma página de texto (cerca de 500 palavras) fica na casa de 700 a 900 tokens.

Duas contagens diferentes entram na fatura:

  • Entrada: tudo que você envia — instruções, exemplos, o documento colado, o histórico da conversa.
  • Saída: tudo que o modelo devolve. Em modelos que raciocinam antes de responder, esse raciocínio interno também é cobrado como saída, mesmo quando não aparece na tela.

A saída custa várias vezes mais caro que a entrada. Por isso a calculadora mostra a parcela da saída no custo: quando ela passa de 60%, pedir respostas mais curtas economiza mais do que enxugar o prompt.

A tabela de preços usada aqui

ModeloEntrada (US$/milhão)Saída (US$/milhão)
Claude Opus 5 (Anthropic)US$ 5.00US$ 25.00
Claude Sonnet 5 (Anthropic)US$ 2.00US$ 10.00
Claude Haiku 4.5 (Anthropic)US$ 1.00US$ 5.00

Valores conferidos na página oficial de preços do fornecedor em 6 de setembro de 2026. Só listamos o que conseguimos confirmar na fonte: para qualquer outro modelo ou fornecedor, escolha "Outro modelo" e copie os dois números da página de preços da sua conta. Preço de API muda com frequência — confirme antes de fechar um orçamento.

Cache de entrada: a economia que quase ninguém liga

Quando o começo do seu prompt se repete a cada chamada (as mesmas instruções, o mesmo catálogo, o mesmo manual), a maioria dos fornecedores permite cachear esse trecho e cobra a leitura por uma fração do preço cheio — a referência usada aqui é 10%.

Em um assistente que carrega o mesmo manual de 20 mil tokens em toda conversa, isso muda a ordem de grandeza da conta. O campo "entrada servida de cache" estima esse ganho. Duas regras práticas: coloque o conteúdo estável no começo do prompt e o que muda no fim, e verifique nos relatórios de uso se o cache está realmente sendo lido — um carimbo de data ou um identificador aleatório no meio do bloco estável invalida tudo o que vem depois.

De estimativa para orçamento

Três motivos fazem o consumo real ficar acima da primeira estimativa: pedidos maiores do que a média, chamadas que rodam de novo porque a primeira falhou ou veio incompleta, e testes durante o desenvolvimento. Some de 20% a 30% de folga antes de prometer um custo a um cliente, e reveja o número depois do primeiro mês com a fatura na mão.

Se o custo vai virar preço, jogue o resultado na calculadora de preço para serviços de IA: ela transforma custo de API, horas e margem no valor a cobrar pelo projeto.

Perguntas frequentes

Como calcular o custo de uma API de IA?

Multiplique os tokens de entrada pelo preço de entrada por milhão, os tokens de saída pelo preço de saída por milhão, some os dois e multiplique pelo número de chamadas do mês. A calculadora faz essa conta e converte para reais.

Quantos tokens tem uma página de texto?

Cerca de 700 a 900 tokens para uma página de aproximadamente 500 palavras em português. Um token equivale a mais ou menos quatro caracteres.

Por que a saída custa mais que a entrada?

Gerar texto exige uma passagem do modelo por token produzido, enquanto o texto de entrada é processado de uma vez. Por isso os fornecedores cobram a saída várias vezes mais caro — e por isso encurtar respostas costuma economizar mais do que encurtar prompts.

O cache reduz mesmo o custo?

Reduz quando um trecho grande do prompt se repete entre chamadas: a leitura do trecho cacheado costuma custar cerca de 10% do preço cheio de entrada. Se o conteúdo muda a cada chamada, não há o que cachear.

Os preços da lista estão atualizados?

A tabela foi conferida na página oficial do fornecedor em 6 de setembro de 2026. Preços de API mudam sem aviso: confirme na fonte antes de fechar um orçamento.

Preços de ferramentas e de APIs são os publicados pelos fornecedores na data indicada em cada página e mudam sem aviso — confirme na fonte antes de decidir. Nenhum valor citado aqui é garantia de faturamento.

Conteúdo e Redes Sociais

Como crescer no Instagram para vender serviços de IA

Quem vende serviço de IA é procurado no perfil antes de ser contratado. O que precisa estar visível, o conteúdo que gera conversa com quem compra e o papel honesto de acelerar o começo.

Marina Costa ·