Planifica costos de IA a partir de cargas de trabajo reales
Explora escenarios comunes de IA, entiende qué determina su costo y abre la calculadora adecuada cuando haya una disponible.
Casos de uso disponibles
Elige el escenario más cercano a tu carga de trabajo.
Chatbot / atención al cliente
Un chatbot de soporte o ventas que mantiene una conversación de ida y vuelta con el usuario. El costo depende principalmente de cuántos turnos tiene la conversación y de cuánto historial se reenvía en cada mensaje.
Qué determina el costo- Conversaciones por mes y mensajes por conversación
- Longitud media de los mensajes (usuario y asistente)
- Tamaño del prompt de sistema, repetido en cada solicitud
- Cuánto historial de la conversación se mantiene en el contexto
Resumen de reuniones
Resumir la transcripción de una reunión en notas y elementos de acción. Esto cubre solo la síntesis — convertir audio en texto (transcripción) es un servicio aparte, con costo propio y separado, y no está incluido.
Qué determina el costo- Reuniones por mes y duración promedio
- Densidad de la transcripción (cuánto texto produce un minuto de habla)
- Nivel de detalle del resumen y extracción opcional de elementos de acción
Resumen de documentos
Resumir un informe u otro documento de texto extenso que ya tienes. El costo depende de la longitud del documento y del nivel de detalle del resumen solicitado — no del número de páginas, que no tiene una conversión de tokens defendible por sí sola.
Qué determina el costo- Documentos por mes y longitud del documento (medida en palabras)
- Nivel de detalle del resumen y extracción opcional de puntos clave
- Los documentos escaneados o basados en imágenes necesitan OCR primero, lo cual no está cubierto aquí
Preguntas sobre documentos
Responder preguntas usando contexto de documentos que ya fue recuperado (generación aumentada por recuperación, o "RAG"). Esto estima solo el paso de inferencia del modelo después de la recuperación — no la infraestructura de recuperación en sí.
Qué determina el costo- Preguntas por mes y longitud promedio de la pregunta
- Cuánto contexto recuperado se entrega por pregunta
- El costo de embeddings, base de datos vectorial e infraestructura de recuperación no está incluido
¿No sabes cuál te conviene? Ver todas las calculadoras →
Casos de uso planificados
Cada calculadora necesita sus propios supuestos de tokens verificados y comprobaciones de precio antes de poder producir una estimación honesta — preferimos publicar una calculadora correcta antes que una que adivine. Estos escenarios se muestran aquí para que veas qué factores de costo cubrirán una vez construidos; todavía no tienen una calculadora funcional, y esta página no estima su costo. Lee la metodología para ver cómo se obtienen y verifican los números de cada calculadora.
Asistente interno de IA
Un único asistente usado internamente por un equipo para búsqueda, redacción y preguntas sobre conocimiento interno combinadas — el costo escala con el número de personas y la frecuencia de uso de cada una. Si lo que te interesa es el costo de las preguntas basadas en recuperación, la calculadora de preguntas sobre documentos ya estima esa parte por sí sola.
- Número de usuarios activos y solicitudes por usuario al día
- Una combinación de redacción, búsqueda y preguntas basadas en recuperación en una sola herramienta
- Tamaño del prompt de sistema y de las instrucciones
Código / generación de aplicaciones
Generar o modificar código con un repositorio o archivo grande como contexto. Los contextos grandes se acercan a los límites de ventana de contexto de muchos modelos.
- Tamaño del código o repositorio enviado como contexto por solicitud
- Longitud de la salida (el código generado suele ser extenso)
- Con qué frecuencia se reenvía el mismo contexto grande en lugar de reutilizarse por caché
Por qué el costo de IA cambia según el caso de uso
Cada escenario anterior se reduce a las mismas palancas — solo se aplican a unidades de trabajo distintas:
- Volumen. Cuántas conversaciones, reuniones, documentos o preguntas ocurren en un mes.
- Tamaño de entrada. Cuánto texto entra al modelo cada vez — un mensaje, una transcripción, un documento, un fragmento de contexto recuperado.
- Tamaño de salida. Cuánto genera el modelo de vuelta — la salida suele facturarse a una tarifa más alta que la entrada.
- Elección del modelo. Qué modelo eliges, ya que el precio por token varía bastante entre modelos.
- Repetición. El contenido reenviado en cada llamada, como un system prompt o el historial de conversación acumulado, multiplica su costo en todas las solicitudes.
Para la lógica de cálculo completa detrás de estas palancas, consulta la metodología.