Latencia: el segundo en que cuelgan
La latencia de respuesta en llamada o mensaje decide si la cita vive o muere. Cómo medirla, dónde se esconde y qué rediseñar en tu primera línea.
Contenido operativo para equipos administrativos de salud. No es consejo médico. Los agentes de Arbol no diagnostican, no prescriben ni orientan clínicamente — escalan a tu equipo.
La latencia es el segundo en que la persona decide colgar, dejar de escribir o buscar otra IPS. No es un detalle técnico de telecomunicaciones: es una variable de acceso. Si tu primera línea tarda en saludar, en ofrecer cupo o en retomar un mensaje, la cita se muere antes de nacer — aunque el equipo “esté ocupado en cosas importantes”.
- Latencia útil no es solo ‘tiempo hasta que suena el teléfono’: es tiempo hasta saludo, hasta oferta de agenda y hasta cierre con estado.
- La Ley 1438 pone oportunidad en el centro; una oportunidad que llega tarde para la persona no es oportunidad operativa.
- WhatsApp domina el hábito de respuesta en Colombia, pero un mensaje sin retoma rápida produce la misma fuga que una llamada en espera eterna.
- Mide latencia por tramo y rediseña cola, horario y automatización de lo repetible antes de contratar más ruido.
La necesidad que no aparece en el tablero
Muchas IPS miran ocupación de recepción, número de llamadas y mensajes respondidos. Pocas miran cuánto tardó la persona en recibir una respuesta útil. Esa omisión es costosa porque la persona no espera con la paciencia de un indicador interno: espera con la lógica de quien necesita resolver hoy.
La Ley 1438 de 2011 incluye oportunidad entre los ejes de la prestación. En la práctica, oportunidad empieza en el primer contacto. La Resolución 3280 de 2018 pide seguimiento: un seguimiento que empieza horas o días después del intento de la persona llega cuando el cupo ya se fue o cuando la persona ya resolvió — o abandonó — por otro lado.
El texto anatomía de la llamada de las 7pm muestra un momento típico de demanda fuera de horario. Este artículo nombra la variable transversal: latencia. No solo de noche. También a las 11:00, cuando recepción atiende ventanilla y el teléfono suena por tercera vez.
Latencia no es una sola cifra
Hay al menos cuatro latencias distintas. Mezclarlas en un promedio único esconde el problema.
- Latencia de saludo: desde que la persona marca o escribe hasta que alguien (o algo) responde.
- Latencia de comprensión: desde el saludo hasta que la institución entiende el motivo.
- Latencia de oferta: desde el motivo hasta que aparecen opciones reales de agenda.
- Latencia de cierre: desde la oferta hasta confirmación, cancelación, reprogramación o escalamiento con estado.
Puedes saludar en dos segundos y aun así perder la cita si la oferta tarda diez minutos porque nadie ve la agenda. Puedes ofrecer cupo rápido y perderla si el cierre no escribe estado y la persona recibe luego un mensaje contradictorio.
La República reportó 91,9% de uso mensual de WhatsApp entre usuarios de internet mayores de 16 años en Colombia. Eso hace más frecuente la latencia silenciosa: la persona no cuelga; simplemente se va. El abandono no suena. Por eso no aparece en el tablero de “llamadas perdidas”.
Dónde se esconde la latencia en una IPS
La latencia rara vez vive en un solo cable. Vive en diseño:
- Una sola persona atiende ventanilla, teléfono y WhatsApp.
- Menús de voz que obligan a escuchar opciones irrelevantes antes de un humano.
- Bandejas personales de mensajería sin turno ni SLA.
- Agenda que no se consulta en el momento del contacto.
- Handoff sin receptor (la transferencia “queda sonando”).
- Fuera de horario sin captura ni callback con ventana.
- Reintentos manuales que dependen de que alguien “se acuerde”.
El mix de canales ayuda a repartir trabajos; la latencia exige además tiempos objetivo por trabajo. Confirmar un “sí” no puede tener la misma cola que resolver una excepción de convenio.
La Ley 1581 de 2012 entra cuando, para “ir más rápido”, el equipo copia datos a chats personales. Esa velocidad falsa crea otra deuda: riesgo de datos. La latencia se ataca con proceso gobernado, no con atajos inseguros.
Cómo medir sin inventar ciencia ficción
No necesitas un laboratorio de telecomunicaciones. Necesitas muestras honestas.
Durante una semana:
- Registra hora de entrada del contacto (llamada o mensaje).
- Registra hora de saludo.
- Registra hora de primera oferta de agenda o de escalamiento declarado.
- Registra hora de cierre con estado.
- Marca abandonos: cuelga, deja de responder, dice “ya no”, o no contesta el callback.
Separa por canal y por franja horaria. La latencia de las 7pm no se parece a la de las 10am. El artículo de la llamada nocturna y el veredicto de capa de contacto apuntan a lo mismo: cobertura y diseño, no heroísmo de recepción.
No hace falta publicar un número inventado de “segundos ideales”. Hace falta comparar tu línea base consigo misma: ¿mejoramos t1 y t2 esta semana? ¿Bajaron los abandonos antes de oferta? ¿Subieron las citas confirmadas en la misma franja?
Latencia y fuera de horario: la cita que nunca entra al tablero
Fuera de horario la latencia se vuelve absoluta: si nadie responde, el tiempo hasta saludo es infinito para esa franja. La persona cuelga, escribe a otra IPS o pospone. Al día siguiente tu tablero muestra “pocas llamadas nocturnas” y concluye, erróneo, que no hay demanda. Había demanda; había latencia total.
Por eso el rediseño no es solo “contestar más rápido de día”. Es decidir qué ocurre a las 7pm: captura con estado, oferta de cupo si la agenda lo permite, o callback con ventana al día siguiente. El silencio total es la peor latencia posible porque ni siquiera deja rastro de abandono. Una primera línea que saluda, clasifica y agenda —o deja tarea con dueño— convierte demanda invisible en trabajo gobernable.
La misma lógica aplica a WhatsApp a mediodía: si el mensaje entra mientras recepción atiende ventanilla, la latencia crece en silencio. Sin turno de retoma, el canal más usado por la población se convierte en el más lento de tu institución. Ese contraste —hábito alto afuera, retoma lenta adentro— es exactamente el segundo en que la persona se va.
Qué rediseñar cuando la latencia mata la cita
Ataques de alto retorno:
- Separa lo repetible. Confirmaciones y opciones simples no deberían esperar detrás de excepciones largas.
- Pon primera línea concurrente para saludo y captura fuera de horario, con límites clínicos claros.
- Ofrece cupo en el primer minuto útil, no después de una entrevista innecesaria.
- Define SLA de retoma en WhatsApp por franja; sin dueño, el canal más usado se vuelve el más lento.
- Diseña handoff con receptor, no transferencia a la nada.
- Callback con ventana cuando no hay humano ahora: incertidumbre cero.
- Mira el pico, no el promedio. Un promedio “aceptable” puede esconder una hora negra donde casi todos cuelgan.
Para el contexto de acceso en Colombia, /colombia/ sitúa el problema de sistema; la latencia es la mecánica cotidiana donde ese problema se vuelve personal.
Un error frecuente es “resolver” la latencia contratando más personas sin cambiar la cola. Si todo sigue pasando por el mismo cuello —ventanilla + teléfono + WhatsApp en la misma persona—, el saludo mejorará un rato y volverá a degradarse en el próximo pico. La latencia se ataca separando trabajos y haciendo concurrente lo repetible. El refuerzo humano sirve para juicio y excepciones, no para repetir confirmaciones eternas.
Otro error es acortar el saludo y alargar la oferta. Un “buenas tardes” inmediato seguido de cinco minutos de silencio mientras alguien busca la agenda sigue siendo latencia mortal. Mide t2, no solo t1. La persona perdona un segundo de espera si después recibe opciones; no perdona un saludo vacío.
Crear la necesidad: si no la mides, ya la estás pagando
La latencia es una necesidad escondida porque duele en otro lado del estado de resultados: cupos vacíos, personas que no vuelven, recepción agotada, inversión en anuncios que no cuaja, quejas por “nadie contesta”. Gerencia discute ausentismo o marketing; debajo hay segundos y minutos sin dueño.
- Toma 20 contactos de voz y 20 de WhatsAppAnota t1, t2, t3 y si hubo abandono antes de oferta.
- Separa franjasMañana, mediodía, tarde y fuera de horario — el promedio único miente.
- Identifica el cuello real¿Saludo lento, agenda lenta, handoff sin receptor o retoma de mensajes?
- Cambia una sola palancaCola, guion corto, cupos visibles o primera línea para lo repetible.
- Revisa citas confirmadas en esa franjaSi la latencia baja y las citas no suben, el problema era otro; si suben, encontraste la palanca.
El segundo en que cuelgan no es un misterio de comportamiento. Es el segundo en que tu operación les dijo, sin palabras, que su tiempo no tenía dueño. Mide esa latencia. Rediseña el tramo que duele. Y trata la velocidad útil como lo que es: una condición de acceso, no un lujo de call center.
Si necesitas un argumento para gerencia, tradúcelo a agenda. Toma una franja negra (por ejemplo, lunes mediodía o domingo noche). Cuenta contactos entrantes, abandonos antes de oferta y citas confirmadas. Luego estima cuántos cupos quedaron vacíos en esa misma franja por cancelaciones no recuperadas. No inventes elasticidades mágicas: muestra la coincidencia. Donde la latencia es alta, el acceso se rompe dos veces — al entrar y al rellenar.
Esa coincidencia suele bastar para justificar un rediseño pequeño: un turno de retoma de WhatsApp, un saludo automático fuera de horario con estado, un menú de voz más corto, o una primera línea que confirme lo repetible mientras recepción atiende ventanilla. No hace falta un proyecto de dos años. Hace falta mirar el reloj con la misma seriedad con la que se mira la ocupación de consultorios.
La latencia también es una señal de respeto. Una institución que responde con oferta clara dice: tu tiempo cuenta. Una institución que deja sonar, que deja el tilde gris, que promete “ya le avisamos”, dice lo contrario. En un mercado donde la persona puede marcar a otra IPS en segundos, esa señal no es cosmética. Es supervivencia operativa del acceso.
Empieza por medir. Sigue por una sola palanca. Termina por mirar citas, no solo tiempos. Cuando el segundo deje de ser el momento en que cuelgan y pase a ser el momento en que reciben una opción real, habrás convertido una necesidad invisible en una ventaja cotidiana.
Fuentes
- Ley 1438 de 2011 — Función Pública
- Resolución 3280 de 2018 — Ministerio de Salud y Protección Social
- WhatsApp, Facebook e Instagram lideran el listado de redes sociales más usadas en el país — La República
- Ley 1581 de 2012 — Función Pública
También te puede interesar
- Anatomía de una llamada perdida: los 6 minutos en que tu IPS pierde un paciente
A las 7:03 PM una mamá marca a tu IPS por la fiebre de su hijo. A las 7:09 tiene cita — en la clínica del frente. Reconstruimos esos 6 minutos y qué tendría que pasar para que terminaran distinto.
- Mix de canales que llena la cita (actualización 2026)
Guía 2026 para combinar WhatsApp, voz y SMS en una IPS colombiana: qué hace cada canal, cuándo usarlo y cómo medir citas cerradas.
- Elegir capa de contacto: veredicto para IPS
Comparación honesta para IPS: recepción, call center, primera línea automatizada o mezcla. Veredicto operativo sin nombres de proveedores.