Conoce la capacidad real de tu API
¿Cuántas peticiones por segundo sirve tu API antes de que suba la latencia?
Una prueba de carga de API envía muchas peticiones en paralelo y mide cada una.
Las consultas lentas, los límites de tasa y los pools de conexiones aparecen de inmediato.
Prueba peticiones reales, no solo un ping
La ejecución gratuita golpea cualquier endpoint público con usuarios simultáneos.
Encadena peticiones para reproducir un flujo real de login y consulta.
Cada ejecución guarda un desglose por petición y una línea de tiempo.
Qué debe medir una prueba de carga de API
Tres cifras cuentan casi toda la historia. Léelas juntas, no una a una.
Latencia: p95 y p99, no la media
La media esconde la cola lenta. Un p99 de dos segundos significa que una llamada de cada cien espera dos segundos, que es lo que notan tus usuarios y lo que dispara tus timeouts.
Rendimiento: peticiones por segundo
El número de peticiones que la API completa cada segundo bajo carga. Cuando añadir usuarios ya no lo sube, has encontrado la capacidad del componente más lento detrás del endpoint.
Tasa de error: 5xx, timeouts y conexiones rechazadas
Los errores que solo aparecen bajo carga apuntan a pools agotados, limitadores de tasa y dependencias externas. Agrúpalos por código de estado y por endpoint para ver cuál se rompe primero.
Cómo hacer una prueba de carga a una API gratis
Cuatro pasos, sin instalar nada, resultados en pocos minutos.
- Introduce la URL del endpoint
Pega la URL pública del endpoint. Los endpoints GET funcionan directamente en la ejecución gratuita; otros métodos y cuerpos se configuran en la aplicación completa. - Elige usuarios y duración
Decide cuántos usuarios virtuales simultáneos simular y durante cuánto tiempo. El plan gratuito cubre una ejecución de 25 usuarios; los planes de pago llegan a miles desde varias regiones. - Ejecútala desde la nube
Inicia la prueba y deja que los generadores de carga hagan el trabajo. Tu propia red nunca es el cuello de botella. - Lee latencia, rendimiento y errores
Los resultados muestran latencia p95 y p99, peticiones por segundo y errores por código de estado, para distinguir un endpoint lento de uno que falla.
Pruebas de carga de API: preguntas frecuentes
¿Qué es una prueba de carga de API?
Una prueba de carga de API envía muchas peticiones simultáneas a un endpoint y mide cómo cambian la latencia, el rendimiento y la tasa de error a medida que crece la carga. Muestra la capacidad de la API y el punto en el que empieza a degradarse.
¿La prueba de carga de API es gratis?
Sí. La ejecución gratuita funciona sin cuenta ni tarjeta y está limitada a 25 usuarios virtuales desde una ubicación. Pruebas más grandes, más regiones y configuración de peticiones requieren una cuenta gratuita o un plan de pago.
¿Puedo enviar peticiones POST con cuerpo JSON?
La ejecución gratuita de esta página envía peticiones GET a una URL pública. Inicia sesión para definir método, cabeceras, autenticación y cuerpo, o sube un script de JMeter o k6 que ya lo haga.
¿Cómo pruebo una API que necesita autenticación?
Añade el token o la clave de API como cabecera en la aplicación completa, o usa un script de JMeter o k6 que inicie sesión primero y reutilice la sesión. No pongas secretos en la URL de una ejecución gratuita.
¿Qué es una buena latencia p95 para una API?
Depende de quién la llama. Como regla general, menos de 200 ms para endpoints detrás de una interfaz de usuario y menos de 1 segundo para tareas en segundo plano. Lo que más importa es que el p95 se mantenga plano al añadir usuarios.
¿Puedo probar un endpoint GraphQL o SOAP?
Sí. Ambos son HTTP por debajo. Las consultas GraphQL y los sobres SOAP se envían como cuerpo de la petición, que configuras en la aplicación completa o en un script.
¿Puedo ejecutar la misma prueba desde varias regiones?
Los usuarios registrados pueden ejecutar una prueba desde más de 25 regiones en la nube a la vez y comparar la latencia por región. La ejecución gratuita usa una sola región.
¿Puedo hacer fallar mi pipeline de CI si la API es demasiado lenta?
Sí. Define umbrales de aprobado o suspenso en una prueba (p95, p99, tasa de error, rendimiento mínimo) y lee el veredicto desde la API o la GitHub Action para bloquear un despliegue.

