¿Qué es la latency (latencia)?

La latencia es el tiempo que tarda una petición en ser procesada, desde que se envía hasta que se recibe la respuesta.

⏱️

Definición

La latencia (latency) es la medida del tiempo que transcurre desde que se inicia una petición o acción hasta que se recibe la respuesta o se completa el resultado. Se expresa típicamente en milisegundos (ms).

🎯

Propósito

Medir la latencia permite evaluar la rapidez de respuesta de un sistema, identificar cuellos de botella y garantizar que la experiencia del usuario cumple con los niveles de servicio esperados.

📊

Métricas

Las métricas de latencia más comunes incluyen: P50 (mediana), P95, P99 y P99.9. Los percentiles altos son especialmente importantes para entender el rendimiento en los peores casos.

🔄

Latencia vs Throughput

Mientras que la latencia mide cuánto tarda una operación individual, el throughput mide cuántas operaciones se completan en un periodo de tiempo. Un sistema puede tener baja latencia pero bajo throughput, o viceversa.

🔍

Fuentes

La latencia total de un sistema incluye latencia de red, latencia de procesamiento, latencia de acceso a datos y latencia de serialización/deserialización.

🍄

더 알고 싶으신가요?

Latency에 대해 더 깊이 알아보고 싶거나 이런 교육을 팀에 도입하고 싶으시다면, 이야기 나눠요. 저는 팀이 이러한 개념을 이해하고 적용할 수 있도록 돕고 있습니다. 연락 주시면 정말 기쁘겠습니다!