Quanto custa um agente de IA?

Um agente de IA não faz apenas uma chamada ao modelo por tarefa — ele faz várias, cada uma reenviando tudo o que já fez até ali. Informe suas tarefas por mês, etapas por tarefa e uso de ferramentas para obter uma faixa mensal Baixo / Esperado / Alto de custo do agente. Tudo roda localmente no seu navegador — nenhum dado é enviado a nenhum servidor.

  • Sem login
  • Sem cartão de crédito
  • Sem chamadas de API
  • Apenas uma estimativa

Configure seu agente de IA

Custo mensal estimado

O T9 estima apenas o custo de inferência/tokens do modelo de linguagem. Não incluído: APIs de busca, APIs de navegação, outras ferramentas externas, bancos de dados vetoriais, hospedagem, infraestrutura ou qualquer outra taxa de serviço de terceiros — esses custos são cobrados separadamente pelas ferramentas e serviços que seu agente chama.

Custo mensal esperado$2.48Faixa estimada: $1.55$3.75
Custo por tarefa
Baixo$0.007725Esperado$0.0124Alto$0.0187
Tokens de entrada / tarefa
Baixo4.3KEsperado7.5KAlto12K
Tokens de saída / tarefa
Baixo1.0KEsperado1.5KAlto2.3K
Total de tokens mensais
Baixo1.1MEsperado1.8MAlto2.8M

Isto é uma estimativa, não uma garantia de cobrança real. O custo real depende do tokenizador do seu provedor, do número real de etapas e do uso de ferramentas do seu agente, e do seu plano de faturamento.

Entenda e confie nestes números Metodologia O que são tokens de IA? Por que a conta te surpreende Calculadora de custo de chatbot

Como esta estimativa funciona

Etapa 1
  • Instrução / system prompt
  • A tarefa original
Etapa 2…N

A mesma instrução e tarefa, reenviadas — mais a saída de cada etapa anterior e os resultados de ferramentas, agora parte do contexto do agente.

Custo

Cada etapa é cobrada pela sua própria contagem de tokens e sua própria tarifa aplicável, depois somadas no custo de uma tarefa.

Um "agente" aqui é um modelo que chama a si mesmo repetidamente para concluir uma tarefa — lendo sua própria saída anterior (e qualquer resultado de ferramenta) a cada etapa antes de decidir o que fazer em seguida. Esta calculadora precifica toda a sequência de chamadas que uma tarefa leva, não apenas uma chamada.

Por que mais etapas aumentam o custo

Cada etapa reenvia as instruções do agente e a tarefa original — essa parte permanece fixa. Mas também reenvia tudo das etapas anteriores, então a última etapa de uma tarefa é sempre a mais cara: a etapa 5 carrega a saída acumulada das etapas 1 a 4 além do seu próprio trabalho. O custo por tarefa cresce mais rápido do que o número de etapas em si, porque etapas posteriores são solicitações maiores do que as anteriores.

Por que o contexto acumulado aumenta o custo

Cada token que o agente já produziu — seu próprio raciocínio e respostas, mais o que qualquer ferramenta retornou — precisa ser reenviado na próxima chamada, porque o modelo não tem memória entre requisições da API. Uma tarefa de 10 etapas não custa 10× uma tarefa de 1 etapa; custa mais, porque as etapas 2 a 10 carregam cada uma mais histórico do que a anterior.

Como as chamadas de ferramenta afetam o uso de tokens

Cada chamada de ferramenta que um agente faz — uma busca, uma chamada de função, uma consulta — retorna um resultado que é adicionado ao contexto para cada etapa seguinte, da mesma forma que a própria saída do modelo. Mais chamadas de ferramenta por etapa, ou ferramentas que retornam resultados maiores, ambas aumentam o tamanho de entrada de cada etapa seguinte e, com isso, o custo do restante da tarefa.

Como a escolha do modelo afeta o custo

Como um agente reenvia todo o seu histórico a cada etapa, o preço do token de entrada importa mais aqui do que em uma carga de trabalho de uma única chamada — e um agente longo e com muitas ferramentas pode ultrapassar o limite de preço de contexto longo de um modelo no meio de uma tarefa, mesmo que a primeira etapa não o faça. Esta calculadora aplica a tarifa atual de entrada/saída de cada modelo, e seu nível de contexto longo se houver, a cada etapa individual.

O que não está incluído: as ferramentas em si

O T9 estima apenas o custo de inferência/tokens do modelo de linguagem. Não incluído: APIs de busca, APIs de navegação, outras ferramentas externas, bancos de dados vetoriais, hospedagem, infraestrutura ou qualquer outra taxa de serviço de terceiros.

Esses custos são cobrados separadamente por qualquer API de busca, ferramenta de navegação, sandbox de código ou outro serviço que seu agente chame — esta estimativa cobre apenas os tokens de entrada e saída do próprio modelo de linguagem.

Baixo / Esperado / Alto explicado

Baixo

Instruções mínimas, tarefa curta, saída por etapa curta, overhead de ferramentas leve ou nenhum.

Esperado

Instruções padrão e comprimento típico de tarefa/saída por etapa. Planeje com base neste número.

Alto

Instruções detalhadas, tarefa longa, saída por etapa longa, overhead de ferramentas pesado. Orce com base neste.

Reduza seu custo

1
Reduza as etapas por tarefa. Menos etapas, mais decisivas, quase sempre superam um loop mais longo e exploratório.
2
Corte o que é reenviado. Resuma ou descarte resultados de ferramentas anteriores do contexto assim que uma etapa não precisar mais deles.
3
Combine o modelo com a tarefa. Um loop de agente longo e com muitas ferramentas raramente precisa de um modelo de ponta em cada etapa.

Exemplos de custo mensal de agentes de IA

Estes exemplos usam as mesmas premissas padrão da calculadora acima — instruções padrão, comprimento médio de tarefa e saída por etapa, uma chamada de ferramenta padrão por etapa, 5 etapas por tarefa — com GPT-5.4 Mini. Apenas o número de tarefas por mês muda entre as linhas. Use a calculadora acima para modelar seu próprio uso ou um modelo diferente.

Nível de usoTarefas / mêsBaixoEsperadoAlto
Uso leve 50 $0.3863 $0.6188 $0.9375
Uso típico 200 $1.55 $2.48 $3.75
Uso intenso 1,000 $7.73 $12.38 $18.75

E aqui está a mesma tarefa padrão, com tudo o mais constante, com um número crescente de etapas — mostrando por que o custo por tarefa não cresce em linha reta com as etapas:

Etapas por tarefaBaixoEsperadoAlto
1 $0.001065 $0.001650 $0.002475
3 $0.003915 $0.006188 $0.009337
5 $0.007725 $0.0124 $0.0187
10 $0.0215 $0.0351 $0.0534

Ressalvas

  • Estas estimativas usam as mesmas faixas de tokens de referência da calculadora de chatbot do site para o comprimento de instrução e de tarefa/saída por etapa, com precisão de ±10–15% para texto em inglês simples.
  • Os tamanhos de overhead de chamada/resultado de ferramenta ("leve"/"padrão"/"pesado") são uma premissa descritiva própria deste projeto, não uma cifra publicada por qualquer provedor — nenhum provedor de IA publica uma especificação de overhead de tokens para uso de ferramentas, já que isso depende inteiramente da ferramenta específica. O overhead real varia bastante por ferramenta; use suas próprias contagens de tokens medidas onde as tiver para a estimativa mais precisa.
  • Cada provedor usa um tokenizador diferente. A contagem real de tokens pode variar ±5–10% entre provedores para o mesmo conteúdo.
  • As ferramentas que um agente chama não são precificadas aqui. APIs de busca, APIs de navegação, outras ferramentas externas, bancos de dados vetoriais, hospedagem e infraestrutura são cobradas separadamente pelos serviços que você usa — esta ferramenta estima apenas o custo de tokens de entrada/saída do próprio modelo de linguagem.
  • Os preços mostrados são verificados manualmente contra a página oficial de preços de cada provedor a partir de 2026-09-08. Os preços dos provedores de IA mudam com frequência — verifique na página oficial de preços do seu provedor antes de tomar decisões de orçamento.
  • O nível de preço de contexto longo, quando o modelo selecionado tem um, é resolvido separadamente para cada etapa de uma tarefa (não uma única vez para toda a tarefa) — uma etapa posterior pode ultrapassar o limite mesmo quando a primeira etapa não o faz, e esta estimativa aplica a tarifa mais alta exatamente à(s) etapa(s) que o fazem.
  • O aviso de janela de contexto acima aparece quando os tokens combinados da maior etapa de uma tarefa excedem 80% da janela de contexto do modelo selecionado — uma margem de segurança antes do risco de truncamento ou falha, não um limite rígido em 100%.

Isto é uma estimativa, não uma garantia de cobrança real. Sempre confirme no painel de uso do seu provedor e nos preços oficiais antes de comprometer um orçamento.