Calculadora de custo de extração de dados

Estime o custo de extração de dados com IA ao obter campos estruturados — fornecedor, data, total, itens de linha e mais — de notas fiscais, recibos, currículos, contratos, formulários e outros documentos de negócio com um modelo de propósito geral. Informe seu volume de documentos, esquema e número de campos para obter uma estimativa mensal Baixo / Esperado / Alto. Tudo roda localmente no seu navegador — nenhum dado é enviado a nenhum servidor.

  • Sem login
  • Sem cartão de crédito
  • Sem chamadas de API
  • Apenas uma estimativa

Configure sua carga de extração

Custo mensal estimado

O T9 estima apenas o custo de inferência/tokens do modelo de linguagem. Não incluído: taxas de fornecedores de OCR, análise de PDF/imagem, taxas de armazenamento de documentos, bancos de dados vetoriais, serviços dedicados de análise/extração via API, ou qualquer outra taxa de terceiros — esses custos são cobrados separadamente (geralmente por página, não por token) pelo serviço que converte seu arquivo de origem em texto processável.

Custo mensal esperado$0.8190Faixa estimada: $0.4878$1.24
Custo por documento
Baixo$0.001626Esperado$0.002730Alto$0.004132
Tokens de entrada / documento
Baixo1.8KEsperado3.0KAlto4.4K
Tokens de saída / documento
Baixo68Esperado115Alto185
Total de tokens mensais
Baixo548KEsperado920KAlto1.4M

Isto é uma estimativa, não uma garantia de cobrança real. O custo real depende do tokenizador do seu provedor, do conteúdo e esquema reais do seu documento, e do seu plano de faturamento.

Entenda e confie nestes números Metodologia O que são tokens de IA? Por que a conta te surpreende Calculadora de resumo de documentos

Como esta estimativa funciona

Entrada — você envia
  • Instruções / esquema de extração
  • O conteúdo de texto do documento
Modelo

Lê o documento e retorna os campos solicitados como dados estruturados (JSON).

Saída — você recebe

Um resultado pequeno e estruturado — os valores extraídos, não mais prosa.

Extração de dados é uma carga de trabalho desequilibrada: o documento que você envia costuma ser muito maior do que o que volta. Esta calculadora precifica os dois lados dessa chamada usando as próprias tarifas de entrada e saída de cada modelo, que frequentemente são bem diferentes entre si.

Por que o tamanho do documento impulsiona o custo de entrada

O texto completo do documento — cada página, cada linha — é enviado como entrada em cada chamada de extração. Um recibo de uma página e um contrato de quarenta páginas custam muito diferente no lado da entrada, mesmo com um esquema de extração idêntico.

Por que o tamanho da instrução/esquema importa

Uma lista curta de campos simples ("fornecedor, data, total") leva muito menos tokens de instrução para especificar do que um esquema grande ou aninhado com regras de tipo, exemplos de formato e notas de casos especiais — e esse texto de instrução é reenviado em cada chamada, assim como qualquer outro system prompt.

Por que itens de linha/registros afetam os tokens de saída

Um currículo tem um registro — um único conjunto de campos. Uma nota fiscal costuma ter vários — um conjunto de campos por item de linha. O tamanho da saída escala com campos × registros, não com o comprimento do documento: uma nota fiscal curta com 20 itens de linha pode produzir mais tokens de saída do que um contrato longo com apenas alguns campos de nível superior.

Por que a escolha do modelo muda o custo

Extração é uma carga de trabalho intensiva em entrada e leve em saída, então o preço de entrada de um modelo costuma importar mais aqui do que o de saída — o ênfase oposto ao de um chat ou de uma carga de geração de conteúdo. Esta calculadora aplica a tarifa atual de entrada e saída de cada modelo para calcular esse equilíbrio com precisão.

Por que documentos longos podem ativar o preço de contexto longo

Alguns modelos cobram uma tarifa mais alta quando os tokens de entrada de uma única solicitação ultrapassam um limite documentado. Um contrato longo ou um lote de páginas escaneadas pode ultrapassar esse limite sozinho, mesmo com um esquema simples — esta calculadora aplica automaticamente o limite verificado e a tarifa mais alta de cada modelo quando um documento o faz.

O que não está incluído: chegar a texto processável

O T9 estima apenas o custo de inferência/tokens do modelo de linguagem. Não incluído: taxas de fornecedores de OCR, análise de PDF/imagem, taxas de armazenamento de documentos, bancos de dados vetoriais, serviços dedicados de análise/extração via API, ou qualquer outra taxa de terceiros.

Essas etapas são cobradas separadamente — geralmente por página, não por token — pelo serviço de OCR ou conversão de documentos que transforma seu arquivo de origem (um PDF escaneado, uma foto de um recibo) em texto que um modelo possa ler. Esta estimativa começa quando esse texto já existe.

Baixo / Esperado / Alto explicado

Baixo

Um documento curto, um esquema mínimo, poucos campos e registros.

Esperado

Um documento típico, esquema padrão, e um número típico de campos/registros. Planeje com base neste número.

Alto

Um documento longo, um esquema detalhado, muitos campos e registros. Orce com base neste.

Reduza seu custo

1
Corte o documento antes da extração. Envie apenas as páginas ou seções que realmente contêm os campos que você precisa.
2
Mantenha o esquema enxuto. Extraia apenas os campos que você realmente vai usar — cada campo adiciona um pouco de saída em cada documento, todo mês.
3
Combine o modelo com a tarefa. Documentos rotineiros e bem estruturados raramente precisam de um modelo de ponta.

Exemplos de custo mensal de extração de dados

Estes exemplos usam as mesmas premissas padrão da calculadora acima — um documento de comprimento médio, esquema padrão, 10 campos, 1 registro por documento — com GPT-5.4 Mini. Apenas o número de documentos por mês muda entre as linhas. Use a calculadora acima para modelar seu próprio uso ou um modelo diferente.

Nível de usoDocumentos / mêsBaixoEsperadoAlto
Uso leve 100 $0.1626 $0.2730 $0.4133
Uso típico 300 $0.4878 $0.8190 $1.24
Uso intenso 2,000 $3.25 $5.46 $8.27

E aqui está o custo por documento para três tipos de documento realistas — um formulário simples, uma nota fiscal com vários itens de linha e um contrato longo — com GPT-5.4 Mini, cada um com seu próprio tamanho de documento, complexidade de esquema e número de campos/registros:

Tipo de documentoBaixoEsperadoAlto
Formulário simples $0.000501 $0.000855 $0.001365
Nota fiscal (com itens) $0.004344 $0.007343 $0.0116
Contrato longo $0.004851 $0.007417 $0.0112

Ressalvas

  • Estas estimativas usam as mesmas faixas de tokens de referência para comprimento de documento e instrução da calculadora de resumo de documentos do site, com precisão de ±10–15% para texto em inglês simples.
  • As cifras de tokens de saída por campo e por registro são uma premissa descritiva própria deste projeto, não uma cifra publicada por qualquer provedor — nenhum provedor de IA publica uma especificação de overhead de tokens para extração estruturada, já que isso depende inteiramente do esquema e dos próprios valores dos campos (um código curto é mais barato do que uma nota longa de texto livre). O tamanho real da saída varia conforme o esquema; use os campos de campos/registros da calculadora para se aproximar o máximo possível do seu próprio esquema.
  • Cada provedor usa um tokenizador diferente. A contagem real de tokens pode variar ±5–10% entre provedores para o mesmo conteúdo.
  • Ir de um arquivo de origem para texto processável não é calculado aqui. Taxas de fornecedores de OCR, análise de PDF/imagem, taxas de armazenamento de documentos, bancos de dados vetoriais e serviços dedicados de análise/extração via API (geralmente cobrados por página) não estão incluídos — esta ferramenta estima apenas o custo de tokens de entrada/saída do próprio modelo de linguagem quando esse texto já existe.
  • Os preços mostrados são verificados manualmente contra a página oficial de preços de cada provedor a partir de 2026-09-08. Os preços dos provedores de IA mudam com frequência — verifique na página oficial de preços do seu provedor antes de tomar decisões de orçamento.
  • O nível de preço de contexto longo, quando o modelo selecionado tem um, é resolvido contra o próprio tamanho de entrada de cada documento, nunca um agregado mensal — um único documento longo pode ativar a tarifa mais alta mesmo quando a maioria dos seus documentos não o faz.
  • O aviso de janela de contexto acima aparece quando os tokens combinados de um documento excedem 80% da janela de contexto do modelo selecionado — uma margem de segurança antes do risco de truncamento ou falha, não um limite rígido em 100%.

Isto é uma estimativa, não uma garantia de cobrança real. Sempre confirme no painel de uso do seu provedor e nos preços oficiais antes de comprometer um orçamento.