Saltar al contenido
mathbehind

Conversor de límites de tasa de API

Convierte entre solicitudes por segundo, minuto y día, y obtén una tasa sostenida segura con margen incluido, no solo la cuenta en bruto.

Tus números

El número que aparece en la documentación de la API.

%

Margen que dejas sin usar, para que las ráfagas y el desfase del reloj no activen el límite.

Solicitudes por segundo

1,000

Solicitudes por minuto
60,0
Solicitudes por hora
3600
Solicitudes por día
86.400
Tasa sostenida segura (con margen)
0,850 sol./s
Intervalo mínimo entre solicitudes
1176 ms
Las cuentas que hay detrás
  1. Solicitudes por segundo

    60 ÷ 60 ses igual a1

  2. Con margen de seguridad

    1 × (1 − 15%)es igual a0,85/s

  3. Intervalo entre solicitudes

    1,000 ms ÷ 0,85es igual a1176,5 ms

Los límites de tasa de una API rara vez se publican en la unidad que realmente necesitas. Un límite documentado como «60 solicitudes por minuto» no te dice cuántos milisegundos esperar entre llamadas, y un límite dado en solicitudes por día no deja claro qué significa para una ráfaga de tráfico en un solo segundo. Esta herramienta convierte entre las cuatro unidades habituales y añade un margen de seguridad, de modo que el número que obtienes sirva para construir un limitador de tasa con garantías.

Cómo funciona

Introduce el límite tal como está documentado (un valor y una unidad: por segundo, minuto, hora o día) y se convierte primero a solicitudes por segundo, porque es la unidad común de la que se deriva todo lo demás.

El margen de seguridad reduce el máximo teórico antes de convertirlo en una tasa sostenida y un intervalo mínimo. El margen importa porque las ráfagas reales de tráfico, el desfase del reloj entre tu servidor y la ventana de límite de la API, y los reintentos tras errores transitorios pueden hacerte superar un límite que en promedio estás respetando.

El intervalo mínimo en milisegundos es lo que usarías en el código, por ejemplo como retardo en un limitador de token bucket o leaky bucket, o un simple `setTimeout` entre llamadas secuenciales.

Un ejemplo resuelto

Un límite de 60 solicitudes por minuto equivale exactamente a 1 solicitud por segundo. Con un margen de seguridad del 15 %, la tasa sostenida segura baja a 0,85 solicitudes por segundo, un intervalo mínimo de unos 1.176 ms entre solicitudes, en lugar de ajustarlo exactamente a 1.000 ms.

Más ejemplos

Un límite de 10.000 solicitudes al día parece grande, pero son solo unas 0,12 solicitudes por segundo, aproximadamente una solicitud cada 10 segundos con un margen del 15 %. Un trabajo por lotes de 50.000 elementos tardaría cinco días con ese límite.

Errores frecuentes

  • Repartir un límite diario de forma uniforme cuando el proveedor también tiene límites por minuto.
  • Funcionar al 100 % del límite, de modo que cualquier ráfaga provoque errores 429.
  • Reintentar inmediatamente tras un 429 en lugar de esperar con retroceso.
  • Olvidar los límites de tokens por minuto en las API de IA, que a menudo se alcanzan antes que los de solicitudes.

Preguntas frecuentes

¿Por qué aplicar un margen de seguridad? ¿No debería ser exacto el límite documentado?

Normalmente es exacto para el rendimiento medio, pero la mayoría de las API aplican los límites sobre una ventana deslizante o fija, y una ráfaga de solicitudes al principio de una ventana puede activar el límite aunque tu tasa media lo cumpla. Un margen del 10 al 20 % es una práctica habitual en limitadores de tasa en producción.

¿Cómo se aplica esto a API de IA como OpenAI, Anthropic o Gemini?

Las API de LLM suelen aplicar dos límites a la vez: solicitudes por minuto (RPM) y tokens por minuto (TPM). Este conversor cubre la parte de RPM; en la práctica, la restricción que manda suele ser el TPM, no el RPM, sobre todo con prompts o respuestas largas. Comprueba qué límite alcanzas primero antes de fiarte de uno solo de los dos números.

¿Cuál es la diferencia entre un límite de token bucket y uno de ventana fija?

Un límite de ventana fija se restablece por completo al inicio de cada ventana (por ejemplo, cada 60 segundos), lo que permite ráfagas de hasta el límite completo en el cambio de ventana. Un límite de token bucket (o de ventana deslizante) se recupera de forma gradual, lo que reparte el tráfico de manera más uniforme. La «tasa sostenida segura» de aquí sirve para ambos, pero las API de ventana fija se benefician en especial de un margen mayor cerca de los límites de ventana.

Mi API da límites distintos para cada endpoint. ¿Cómo los combino?

Convierte el límite de cada endpoint por separado con esta herramienta; los límites de tasa casi siempre se miden por endpoint (o por clave de API más endpoint), no se agrupan en toda tu cuenta, salvo que la documentación diga explícitamente lo contrario.

¿Cómo convierto solicitudes por minuto a solicitudes por segundo?

Divide entre 60. Un límite de 600 solicitudes por minuto da una media de 10 solicitudes por segundo, y 3.000 por minuto son 50 por segundo. Recuerda que algunas API aplican el límite en ventanas más cortas, así que las ráfagas aún pueden rechazarse aunque la media esté bien.