Estime o custo de IA do seu chatbot antes que a fatura te surpreenda

Informe o uso esperado do seu chatbot para obter uma estimativa de custo mensal de API Baixo / Esperado / Alto. Tudo roda localmente no seu navegador — nenhum dado é enviado a um servidor.

  • Sem login
  • Sem cartão de crédito
  • Sem chamadas de API
  • Apenas uma estimativa

Configure seu chatbot

Custo mensal estimado

Custo mensal esperado$7.99Faixa estimada: $4.89$12.52
Custo por conversa
Baixo$0.004890Esperado$0.007987Alto$0.0125
Tokens de entrada / conversa
Baixo520Esperado1.6KAlto3.2K
Tokens de saída / conversa
Baixo1.0KEsperado1.5KAlto2.3K
Tokens de entrada mensais
Baixo520KEsperado1.6MAlto3.2M
Tokens de saída mensais
Baixo1.0MEsperado1.5MAlto2.3M

Isto é uma estimativa, não uma garantia de cobrança real. O custo real depende do tokenizador do seu provedor, do tamanho real das conversas e do seu plano de faturamento.

Entenda e confie nesses números Metodologia O que são tokens de IA? Por que as contas surpreendem Todos os guias

Como esta estimativa funciona

Entrada — você envia
  • System prompt
  • Mensagem atual do usuário
  • Histórico do chat
  • Contexto de base de conhecimento
Modelo

Lê tudo o que você envia e então escreve uma resposta.

Saída — você recebe

A resposta do modelo. A saída costuma custar de 3 a 10 vezes mais que a entrada.

O contexto de base de conhecimento conta como entrada extra. Esta calculadora assume uma recuperação por conversa — se o seu sistema recupera a cada mensagem, o custo real é maior.

Por que o histórico aumenta o custo

Cada nova mensagem reenvia toda a conversa até aquele ponto, então mensagens posteriores continuam pagando pelas anteriores.

Um chat de 5 mensagens custa muito mais que 5× uma mensagem. O padrão Esperado — 1.650 tokens de entrada — reflete isso; ignorar o histórico subestima o custo em 3 a 5 vezes.

Baixo / Esperado / Alto explicados

Baixo

Mensagens curtas, respostas curtas, 1 turno anterior de histórico mantido.

Esperado

Premissas intermediárias da metodologia do T9. Planeje com base neste número.

Alto

Mensagens e respostas mais longas, 5 turnos anteriores de histórico. Faça o orçamento com base neste número.

Reduza seu custo

1
Encurte o system prompt. Cada token nele se repete em cada chamada.
2
Limite o histórico. Uma janela deslizante de 3 turnos pode reduzir o custo de entrada em 50–70% em chats longos.
3
Combine o modelo com a tarefa. A maioria das FAQs de suporte funciona bem em um modelo capaz de nível intermediário.

Exemplos de custo mensal

Estes exemplos práticos usam as mesmas premissas padrão da calculadora acima — um prompt de sistema padrão, mensagens e respostas de tamanho médio, 5 mensagens por conversa, sem base de conhecimento — com GPT-5.4 Mini. Apenas o número de conversas por mês muda entre as linhas. Use a calculadora acima para modelar seu próprio uso ou um modelo diferente.

Nível de usoConversas / mêsBaixoEsperadoAlto
Uso leve 200 $0.9780 $1.60 $2.50
Uso típico 1,000 $4.89 $7.99 $12.52
Uso intenso 5,000 $24.45 $39.94 $62.62

Ressalvas

  • Essas estimativas usam a fórmula caracteres ÷ 4 ≈ tokens, precisa em ±10–15% para texto em inglês simples.
  • Cada provedor usa um tokenizador diferente. As contagens reais de tokens podem diferir ±5–10% entre OpenAI, Anthropic, Google, Mistral e DeepSeek para o mesmo conteúdo.
  • Se o seu chatbot lida com conversas em português ou espanhol, espere contagens de tokens 10–25% mais altas do que as mostradas — esses idiomas tokenizam de forma menos eficiente que o inglês.
  • Os preços mostrados são verificados manualmente na página oficial de preços de cada provedor em 2026-09-08. O preço dos provedores de IA muda com frequência — verifique na página oficial de preços do seu provedor antes de tomar decisões de orçamento.
  • Os preços e as janelas de contexto dos modelos são verificados diretamente na página de preços e na documentação oficial de cada provedor antes de serem adicionados aqui — veja a referência de preços para a data de verificação e o método de obtenção.
  • Os custos de base de conhecimento assumem uma recuperação por conversa. Se o seu sistema recupera conteúdo novo a cada mensagem, multiplique o custo da base de conhecimento pelo número de mensagens.
  • O aviso sobre a janela de contexto acima aparece quando os tokens combinados do cenário Alto ultrapassam 80% da janela de contexto do modelo selecionado — uma margem de segurança antes do risco de truncamento ou falha, não um limite rígido em 100%.

Isto é uma estimativa, não uma garantia de faturamento. Sempre confirme com o painel de uso do seu provedor e os preços oficiais antes de comprometer um orçamento.