¿Cuánto cuesta un agente de IA?
Un agente de IA no hace una sola llamada al modelo por tarea — hace varias, y cada una reenvía todo lo que ha hecho hasta ese momento. Ingresa tus tareas por mes, pasos por tarea y uso de herramientas para obtener un rango mensual Bajo / Probable / Alto del costo del agente. Todo se ejecuta localmente en tu navegador — no se envía ningún dato a ningún servidor.
- Sin inicio de sesión
- Sin tarjeta de crédito
- Sin llamadas a la API
- Solo una estimación
Configure su agente de IA
Costo mensual estimado
T9 estima únicamente el costo de inferencia/tokens del modelo de lenguaje. No incluido: APIs de búsqueda, APIs de navegación, otras herramientas externas, bases de datos vectoriales, alojamiento, infraestructura ni ninguna otra tarifa de servicio de terceros — esos costos los cobran por separado las herramientas y servicios que su agente utiliza.
Esto es una estimación, no una garantía de facturación real. El costo real depende del tokenizador de su proveedor, el número real de pasos y el uso de herramientas de su agente, y su plan de facturación.
Cómo funciona esta estimación
- Instrucción / system prompt
- La tarea original
La misma instrucción y tarea, reenviadas — más la salida de cada paso anterior y los resultados de herramientas, ahora parte del contexto del agente.
Cada paso se factura con su propio conteo de tokens y su propia tarifa aplicable, y luego se suman en el costo de una tarea.
Un "agente" aquí es un modelo que se llama a sí mismo repetidamente para completar una tarea — leyendo su propia salida anterior (y cualquier resultado de herramienta) en cada paso antes de decidir qué hacer a continuación. Esta calculadora calcula el precio de toda la secuencia de llamadas que toma una tarea, no solo de una llamada.
Por qué más pasos aumentan el costo
Cada paso reenvía las instrucciones del agente y la tarea original — esa parte se mantiene fija. Pero también reenvía todo lo de los pasos anteriores, así que el último paso de una tarea siempre es el más costoso: el paso 5 lleva la salida acumulada de los pasos 1 a 4 además de su propio trabajo. El costo por tarea crece más rápido que el número de pasos en sí, porque los pasos posteriores son solicitudes más grandes que los anteriores.
Por qué el contexto acumulado aumenta el costo
Cada token que el agente ya produjo — su propio razonamiento y respuestas, más lo que devolvió cualquier herramienta — debe reenviarse en la siguiente llamada, porque el modelo no tiene memoria entre solicitudes de la API. Una tarea de 10 pasos no cuesta 10× una tarea de 1 paso; cuesta más, porque los pasos 2 al 10 llevan cada uno más historial que el anterior.
Cómo afectan las llamadas a herramientas el uso de tokens
Cada llamada a una herramienta que hace un agente — una búsqueda, una llamada a función, una consulta — devuelve un resultado que se agrega al contexto para cada paso siguiente, igual que la propia salida del modelo. Más llamadas a herramientas por paso, o herramientas que devuelven resultados más grandes, ambas aumentan el tamaño de entrada de cada paso posterior y, con ello, el costo del resto de la tarea.
Cómo afecta la elección del modelo al costo
Como un agente reenvía todo su historial en cada paso, el precio del token de entrada importa más aquí que en una carga de trabajo de una sola llamada — y un agente largo y con muchas herramientas puede superar el umbral de precio de contexto largo de un modelo a mitad de una tarea, aunque el primer paso no lo haga. Esta calculadora aplica la tarifa actual de entrada/salida de cada modelo, y su nivel de contexto largo si lo tiene, a cada paso individual.
Qué no está incluido: las herramientas en sí
T9 estima únicamente el costo de inferencia/tokens del modelo de lenguaje. No incluido: APIs de búsqueda, APIs de navegación, otras herramientas externas, bases de datos vectoriales, alojamiento, infraestructura ni ninguna otra tarifa de servicio de terceros.
Esos costos los cobra por separado cualquier API de búsqueda, herramienta de navegación, sandbox de código u otro servicio que use tu agente — esta estimación cubre solo los tokens de entrada y salida del propio modelo de lenguaje.
Bajo / Probable / Alto explicado
Instrucciones mínimas, tarea corta, salida por paso corta, overhead de herramientas ligero o nulo.
Instrucciones estándar y longitud típica de tarea/salida por paso. Planifica con base en este número.
Instrucciones detalladas, tarea larga, salida por paso larga, overhead de herramientas pesado. Presupuesta con base en este.
Reduce tu costo
Ejemplos de costo mensual de agentes de IA
Estos ejemplos usan los mismos supuestos predeterminados que la calculadora de arriba — instrucciones estándar, longitud media de tarea y salida por paso, una llamada estándar a herramienta por paso, 5 pasos por tarea — con GPT-5.4 Mini. Solo cambia el número de tareas por mes entre filas. Usa la calculadora de arriba para modelar tu propio uso o un modelo diferente.
| Nivel de uso | Tareas / mes | Bajo | Probable | Alto |
|---|---|---|---|---|
| Uso ligero | 50 | $0.3863 | $0.6188 | $0.9375 |
| Uso típico | 200 | $1.55 | $2.48 | $3.75 |
| Uso intensivo | 1,000 | $7.73 | $12.38 | $18.75 |
Y aquí está la misma tarea predeterminada, con todo lo demás constante, con un número creciente de pasos — mostrando por qué el costo por tarea no crece en línea recta con los pasos:
| Pasos por tarea | Bajo | Probable | Alto |
|---|---|---|---|
| 1 | $0.001065 | $0.001650 | $0.002475 |
| 3 | $0.003915 | $0.006188 | $0.009337 |
| 5 | $0.007725 | $0.0124 | $0.0187 |
| 10 | $0.0215 | $0.0351 | $0.0534 |
Advertencias
- Estas estimaciones usan los mismos rangos de tokens de referencia que la calculadora de chatbot del sitio para la longitud de instrucción y de tarea/salida por paso, con una precisión de ±10–15% para texto en inglés simple.
- Los tamaños de overhead de llamadas/resultados de herramientas ("ligero"/"estándar"/"pesado") son un supuesto descriptivo propio de este proyecto, no una cifra publicada por ningún proveedor — ningún proveedor de IA publica una especificación de overhead de tokens para el uso de herramientas, ya que depende totalmente de la herramienta específica. El overhead real varía mucho según la herramienta; usa tus propios conteos de tokens medidos donde los tengas para la estimación más precisa.
- Cada proveedor usa un tokenizador diferente. El conteo real de tokens puede variar ±5–10% entre proveedores para el mismo contenido.
- Las herramientas que utiliza un agente no se calculan aquí. Las APIs de búsqueda, APIs de navegación, otras herramientas externas, bases de datos vectoriales, alojamiento e infraestructura se facturan por separado según los servicios que uses — esta herramienta solo estima el costo de tokens de entrada/salida del propio modelo de lenguaje.
- Los precios mostrados se verifican manualmente contra la página oficial de precios de cada proveedor a partir del 2026-09-08. Los precios de los proveedores de IA cambian con frecuencia — verifica en la página oficial de precios de tu proveedor antes de tomar decisiones de presupuesto.
- El nivel de precio de contexto largo, cuando el modelo seleccionado tiene uno, se resuelve por separado para cada paso de una tarea (no una sola vez para toda la tarea) — un paso posterior puede superar el umbral aunque el primer paso no lo haga, y esta estimación aplica la tarifa más alta exactamente al (a los) paso(s) que lo hacen.
- La advertencia de ventana de contexto de arriba aparece cuando los tokens combinados del paso más grande de una tarea superan el 80% de la ventana de contexto del modelo seleccionado — un margen de seguridad antes del riesgo de truncamiento o fallo, no un límite estricto en el 100%.
Esto es una estimación, no una garantía de facturación real. Siempre confirma con el panel de uso de tu proveedor y sus precios oficiales antes de comprometer un presupuesto.