Los precios por token parecen minúsculos, pero una función de chat los multiplica de una forma fácil de pasar por alto: cada mensaje reenvía toda la conversación hasta ese momento. Esta calculadora modela ese crecimiento para que puedas poner precio a una función de IA antes de que llegue la primera factura.
Cifras comprobadas el por Muhammad Ahmad con Precios de la API de OpenAI, Precios de la API de Claude y Precios de la API de Gemini. Los precios y las normas cambian, así que confírmalos con la fuente oficial antes de basarte en ellos. Cómo verificamos las cuentas
Cómo funciona
Cada mensaje envía el prompt del sistema, el nuevo mensaje del usuario y, en un chat normal, todos los mensajes y respuestas anteriores. Así, la entrada del mensaje 6 incluye los mensajes del 1 al 5 y sus respuestas.
Para m mensajes, los tokens de entrada totales son m × sistema + m × usuario + (usuario + respuesta) × m(m − 1) ÷ 2. El último término es el historial del chat y crece con el cuadrado de la longitud de la conversación.
El coste es tokens de entrada ÷ 1.000.000 × el precio de entrada del modelo, más tokens de salida ÷ 1.000.000 × su precio de salida. Los precios proceden del mismo conjunto de datos verificado que la calculadora de coste de API de IA.
Un ejemplo resuelto
Un chat de 6 mensajes con un prompt del sistema de 800 tokens, mensajes de 60 tokens y respuestas de 300 tokens usa 10.560 tokens de entrada y 1.800 de salida. En Claude Sonnet 5 (2 $ de entrada y 10 $ de salida por millón), son 0,0391 $ por conversación. Con 1.000 usuarios que tienen 10 conversaciones al mes, la factura es de 391,20 $ al mes, o 0,39 $ por usuario.
Más ejemplos
La carga de trabajo por defecto de un chatbot, 10.000 conversaciones al mes, cuesta 391,20 $ en Claude Sonnet 5 o GPT-6 Sol, y 19,56 $ en GPT-6 Luna.
No enviar historial (peticiones independientes) reduce la entrada de 10.560 a 5.160 tokens por conversación, y la factura de Sonnet 5 de 391,20 $ a 283,20 $.
Errores frecuentes
- Dejar fuera el historial de la conversación, que se reenvía con cada mensaje.
- Calcular el precio con usuarios medios cuando los usuarios intensivos generan la mayor parte del coste.
- Olvidar los tokens de razonamiento, que se facturan como salida en los modelos que piensan.
- No volver a comprobar los precios tras sus cambios, que fueron frecuentes en 2026.
Preguntas frecuentes
¿Por qué importa tanto la longitud de la conversación?
Como el historial se reenvía con cada mensaje, un chat de 12 mensajes cuesta mucho más del doble que uno de 6. Limitar el historial, resumir los turnos antiguos o empezar conversaciones nuevas mantiene los costes predecibles.
¿Cambia el resultado el almacenamiento en caché de prompts?
Sí. La mayoría de los proveedores aplican ahora un descuento a la entrada repetida, como un prompt del sistema largo, cuando está en caché. Esta calculadora usa precios estándar, así que considera el resultado una estimación máxima si usas caché.
¿Cómo cuento los tokens?
En inglés, un token equivale a unas tres cuartas partes de una palabra, así que 100 palabras son unos 133 tokens. Usa el conversor de tokens y palabras para traducir la longitud de tus propios prompts.
¿Cuánto cuesta mantener un chatbot de IA?
Multiplica los tokens de una conversación media por los precios del modelo y luego por las conversaciones al mes. Las conversaciones largas cuestan mucho más que las cortas, porque todo el historial se reenvía con cada mensaje.
¿Cómo puedo reducir el coste de una función de IA?
Guarda en caché el prompt del sistema fijo, recorta o resume los historiales de chat largos, deriva las peticiones sencillas a un modelo más pequeño y fija límites razonables a la longitud de las conversaciones o a los mensajes por usuario.