Calculadora de custo de extração de dados
Estime o custo de extração de dados com IA ao obter campos estruturados — fornecedor, data, total, itens de linha e mais — de notas fiscais, recibos, currículos, contratos, formulários e outros documentos de negócio com um modelo de propósito geral. Informe seu volume de documentos, esquema e número de campos para obter uma estimativa mensal Baixo / Esperado / Alto. Tudo roda localmente no seu navegador — nenhum dado é enviado a nenhum servidor.
- Sem login
- Sem cartão de crédito
- Sem chamadas de API
- Apenas uma estimativa
Configure sua carga de extração
Custo mensal estimado
O T9 estima apenas o custo de inferência/tokens do modelo de linguagem. Não incluído: taxas de fornecedores de OCR, análise de PDF/imagem, taxas de armazenamento de documentos, bancos de dados vetoriais, serviços dedicados de análise/extração via API, ou qualquer outra taxa de terceiros — esses custos são cobrados separadamente (geralmente por página, não por token) pelo serviço que converte seu arquivo de origem em texto processável.
Isto é uma estimativa, não uma garantia de cobrança real. O custo real depende do tokenizador do seu provedor, do conteúdo e esquema reais do seu documento, e do seu plano de faturamento.
Como esta estimativa funciona
- Instruções / esquema de extração
- O conteúdo de texto do documento
Lê o documento e retorna os campos solicitados como dados estruturados (JSON).
Um resultado pequeno e estruturado — os valores extraídos, não mais prosa.
Extração de dados é uma carga de trabalho desequilibrada: o documento que você envia costuma ser muito maior do que o que volta. Esta calculadora precifica os dois lados dessa chamada usando as próprias tarifas de entrada e saída de cada modelo, que frequentemente são bem diferentes entre si.
Por que o tamanho do documento impulsiona o custo de entrada
O texto completo do documento — cada página, cada linha — é enviado como entrada em cada chamada de extração. Um recibo de uma página e um contrato de quarenta páginas custam muito diferente no lado da entrada, mesmo com um esquema de extração idêntico.
Por que o tamanho da instrução/esquema importa
Uma lista curta de campos simples ("fornecedor, data, total") leva muito menos tokens de instrução para especificar do que um esquema grande ou aninhado com regras de tipo, exemplos de formato e notas de casos especiais — e esse texto de instrução é reenviado em cada chamada, assim como qualquer outro system prompt.
Por que itens de linha/registros afetam os tokens de saída
Um currículo tem um registro — um único conjunto de campos. Uma nota fiscal costuma ter vários — um conjunto de campos por item de linha. O tamanho da saída escala com campos × registros, não com o comprimento do documento: uma nota fiscal curta com 20 itens de linha pode produzir mais tokens de saída do que um contrato longo com apenas alguns campos de nível superior.
Por que a escolha do modelo muda o custo
Extração é uma carga de trabalho intensiva em entrada e leve em saída, então o preço de entrada de um modelo costuma importar mais aqui do que o de saída — o ênfase oposto ao de um chat ou de uma carga de geração de conteúdo. Esta calculadora aplica a tarifa atual de entrada e saída de cada modelo para calcular esse equilíbrio com precisão.
Por que documentos longos podem ativar o preço de contexto longo
Alguns modelos cobram uma tarifa mais alta quando os tokens de entrada de uma única solicitação ultrapassam um limite documentado. Um contrato longo ou um lote de páginas escaneadas pode ultrapassar esse limite sozinho, mesmo com um esquema simples — esta calculadora aplica automaticamente o limite verificado e a tarifa mais alta de cada modelo quando um documento o faz.
O que não está incluído: chegar a texto processável
O T9 estima apenas o custo de inferência/tokens do modelo de linguagem. Não incluído: taxas de fornecedores de OCR, análise de PDF/imagem, taxas de armazenamento de documentos, bancos de dados vetoriais, serviços dedicados de análise/extração via API, ou qualquer outra taxa de terceiros.
Essas etapas são cobradas separadamente — geralmente por página, não por token — pelo serviço de OCR ou conversão de documentos que transforma seu arquivo de origem (um PDF escaneado, uma foto de um recibo) em texto que um modelo possa ler. Esta estimativa começa quando esse texto já existe.
Baixo / Esperado / Alto explicado
Um documento curto, um esquema mínimo, poucos campos e registros.
Um documento típico, esquema padrão, e um número típico de campos/registros. Planeje com base neste número.
Um documento longo, um esquema detalhado, muitos campos e registros. Orce com base neste.
Reduza seu custo
Exemplos de custo mensal de extração de dados
Estes exemplos usam as mesmas premissas padrão da calculadora acima — um documento de comprimento médio, esquema padrão, 10 campos, 1 registro por documento — com GPT-5.4 Mini. Apenas o número de documentos por mês muda entre as linhas. Use a calculadora acima para modelar seu próprio uso ou um modelo diferente.
| Nível de uso | Documentos / mês | Baixo | Esperado | Alto |
|---|---|---|---|---|
| Uso leve | 100 | $0.1626 | $0.2730 | $0.4133 |
| Uso típico | 300 | $0.4878 | $0.8190 | $1.24 |
| Uso intenso | 2,000 | $3.25 | $5.46 | $8.27 |
E aqui está o custo por documento para três tipos de documento realistas — um formulário simples, uma nota fiscal com vários itens de linha e um contrato longo — com GPT-5.4 Mini, cada um com seu próprio tamanho de documento, complexidade de esquema e número de campos/registros:
| Tipo de documento | Baixo | Esperado | Alto |
|---|---|---|---|
| Formulário simples | $0.000501 | $0.000855 | $0.001365 |
| Nota fiscal (com itens) | $0.004344 | $0.007343 | $0.0116 |
| Contrato longo | $0.004851 | $0.007417 | $0.0112 |
Ressalvas
- Estas estimativas usam as mesmas faixas de tokens de referência para comprimento de documento e instrução da calculadora de resumo de documentos do site, com precisão de ±10–15% para texto em inglês simples.
- As cifras de tokens de saída por campo e por registro são uma premissa descritiva própria deste projeto, não uma cifra publicada por qualquer provedor — nenhum provedor de IA publica uma especificação de overhead de tokens para extração estruturada, já que isso depende inteiramente do esquema e dos próprios valores dos campos (um código curto é mais barato do que uma nota longa de texto livre). O tamanho real da saída varia conforme o esquema; use os campos de campos/registros da calculadora para se aproximar o máximo possível do seu próprio esquema.
- Cada provedor usa um tokenizador diferente. A contagem real de tokens pode variar ±5–10% entre provedores para o mesmo conteúdo.
- Ir de um arquivo de origem para texto processável não é calculado aqui. Taxas de fornecedores de OCR, análise de PDF/imagem, taxas de armazenamento de documentos, bancos de dados vetoriais e serviços dedicados de análise/extração via API (geralmente cobrados por página) não estão incluídos — esta ferramenta estima apenas o custo de tokens de entrada/saída do próprio modelo de linguagem quando esse texto já existe.
- Os preços mostrados são verificados manualmente contra a página oficial de preços de cada provedor a partir de 2026-09-08. Os preços dos provedores de IA mudam com frequência — verifique na página oficial de preços do seu provedor antes de tomar decisões de orçamento.
- O nível de preço de contexto longo, quando o modelo selecionado tem um, é resolvido contra o próprio tamanho de entrada de cada documento, nunca um agregado mensal — um único documento longo pode ativar a tarifa mais alta mesmo quando a maioria dos seus documentos não o faz.
- O aviso de janela de contexto acima aparece quando os tokens combinados de um documento excedem 80% da janela de contexto do modelo selecionado — uma margem de segurança antes do risco de truncamento ou falha, não um limite rígido em 100%.
Isto é uma estimativa, não uma garantia de cobrança real. Sempre confirme no painel de uso do seu provedor e nos preços oficiais antes de comprometer um orçamento.