Un día de lanzamiento no falla despacio. Falla de golpe.
La planificación de capacidad supone que el tráfico llega a un ritmo. La apertura de la venta, el lanzamiento de una campaña, los resultados de un examen o la apertura de citas no llegan a un ritmo: llegan en un instante. La aplicación tampoco se degrada con educación: el pool de conexiones se llena, la base de datos se encola, los tiempos de respuesta suben y los usuarios recargan, lo que duplica la carga que causó el problema.
Las respuestas habituales lo empeoran. El autoescalado añade instancias cuando el pico ya ha caído y la base de datos ya es el cuello de botella. La limitación de velocidad rechaza peticiones — algo que, para quien hace cola por una entrada de concierto, es indistinguible de un sitio roto. Ambas dejan la misma impresión: en el momento en que más quería estar listo, no lo estaba.
Una sala de espera cambia la forma del problema. A la multitud no se la rechaza ni se la descarta: se la ordena. La aplicación sirve el número que sirve bien, el resto guarda un sitio con posición y estimación, y la plataforma admite al siguiente en cuanto se libera un lugar.
Nuestro enfoque
La cola se ejecuta en la plataforma de entrega, delante de la aplicación, de modo que sigue en pie cuando la aplicación ya está al límite — y ninguna línea de código de la aplicación participa en admitir, retener o liberar a nadie.
Un techo que la aplicación realmente puede servir
Fije el número máximo de visitantes admitidos a la vez en un servicio publicado. Ese número sale de lo que la aplicación demuestra soportar bien, no de lo que el hardware podría dejar pasar en teoría.
Una puerta al ritmo de llegada, no solo al tamaño de la multitud
Un techo aparte limita cuántos visitantes nuevos pueden entrar por minuto. Es lo que protege a un backend que aguanta una población grande y estable pero se derrumba cuando diez mil personas llegan en el mismo segundo.
Modo observación — la capacidad se encuentra antes del evento
Ejecute la sala de espera en modo observación y contará lo que habría pasado sin retener a nadie. Dimensiona la cola con su propio tráfico, en un día normal, y llega al evento con un número en el que confía en vez de uno que adivinó.
Los bots verificados no ocupan sitio en la cola
Los buscadores verificados y las sondas de monitorización se reconocen y quedan exentos: la indexación y las comprobaciones de disponibilidad continúan durante el evento y no se gasta ningún sitio en tráfico que no iba a comprar nada.
Capacidades
Todo lo siguiente se configura por servicio publicado, en la misma pantalla que el resto de la política de tráfico, y cada cambio surte efecto por recarga en caliente — incluso durante el evento.
Máximo de visitantes simultáneos, por servicio publicado
Cada aplicación tiene sus límites y un mismo equipo puede ejecutar una sala de espera distinta para cada una al mismo tiempo. El techo es una propiedad del servicio, no de la caja.
Nuevos visitantes por minuto — protección ante picos
La puerta de llegada es independiente del techo de concurrencia. Un pool cómodo con 20.000 personas dentro puede destruirse igualmente si 20.000 llegan de golpe; este control separa ambos casos.
Páginas de espera condicionales — solo donde importa
La cola se aplica por condición: las rutas de pago y de entradas quedan protegidas mientras el catálogo, la ayuda y la página de estado siguen abiertos. El visitante espera por lo escaso, no por todo el sitio.
Posición y tiempo estimado, a la vista del visitante
Una cola sin número es indistinguible de una página colgada. La página de espera muestra dónde está el visitante y cuánto es probable que tarde: esa es la diferencia entre esperar e irse.
El sitio se conserva — recargar no lo cuesta
La posición va ligada a la sesión del visitante: recargar, perder la conexión o pasar de datos móviles a Wi-Fi no manda a nadie al final. Las tormentas de recarga dejan de ser un daño autoinfligido.
Su propia página de espera
La página es una plantilla que usted controla — su marca, su idioma, su mensaje — servida por la plataforma incluso cuando la aplicación detrás está totalmente ocupada.
Admisión en cuanto se libera un sitio
A medida que terminan las sesiones, los siguientes visitantes se liberan automáticamente. Nadie espera a un temporizador que ha dejado de corresponderse con la realidad.
Visibilidad en vivo durante el evento
Profundidad de la cola, admisiones por minuto, espera media y abandono están en pantalla mientras ocurre el evento: la decisión de subir o bajar el techo se toma con evidencia.
Profundidad operacional
Una sala de espera vale lo que valga su comportamiento en los casos incómodos: una conmutación en mitad del evento, una flota de bots en la cola, un visitante con conexión inestable.
La cola está en la plataforma, no en la aplicación
Sin agente, sin biblioteca, sin cambios de código y sin un servicio de colas que operar. La aplicación nunca se entera de que existe una sala de espera; simplemente no ve más tráfico del que puede servir.
Orden justo, ligado a la sesión
La admisión es por orden de llegada y la posición viaja con la sesión del visitante en vez de con una IP: un NAT corporativo, un CGNAT de operador o una línea de oficina compartida no ponen a todos uno detrás de otro.
Se combina con el resto de la protección
El scoring de bots se ejecuta antes de la cola, así que el tráfico automatizado se trata en lugar de encolarse. La limitación de velocidad sigue aplicándose a quien está dentro. La sala de espera gestiona a la multitud honesta; no se le pide ser un control de seguridad.
Sobrevive a una conmutación
El estado de la cola se replica en el clúster: la caída de un nodo durante una apertura de venta no reinicia la fila. El evento continúa en el nodo superviviente con las posiciones intactas.
Comportamiento al recargar, con pestañas nuevas y dispositivos compartidos
Una segunda pestaña se une al mismo sitio en lugar de ocupar otro. Hay reglas explícitas para la expiración de sesión y el abandono: los sitios que dejan los visitantes que se van vuelven a la cola.
Se activa y desactiva durante el evento
Toda la función es un cambio en caliente. Puede activarse minutos antes de la apertura y desactivarse en cuanto pasa el pico, sin perder una conexión ni reiniciar nada.
Cuándo usarlo
Aperturas de venta y ticketing
Conciertos, partidos y ventas de viajes concentran el tráfico de un año en noventa segundos. La sala de espera convierte un pico inservible en una fila ordenada y cada visitante conserva un sitio que puede ver.
Lanzamientos de producto y campañas
Una campaña que funciona es, en la capa de red, indistinguible de un ataque. La sala de espera permite que marketing tenga éxito sin pedir a la infraestructura que absorba todo ese éxito en un segundo.
Ventanas de solicitud en el sector público
Resultados de exámenes, plazos fiscales y apertura de citas se anuncian a toda una población con minuto exacto. Una cola con posición visible es además la respuesta más justa que se puede dar a la ciudadanía.
Picos de nómina y fin de mes en banca
Picos previsibles y repetidos no justifican dimensionar la plataforma de forma permanente para la peor hora del mes. La sala de espera cubre el pico y la plataforma sigue dimensionada para el día normal.
Preguntas frecuentes
¿En qué se diferencia de la limitación de velocidad?
¿Hay que cambiar la aplicación?
¿Cómo elegimos el número correcto de concurrencia?
¿Qué pasa si un visitante recarga o pierde la conexión?
¿Se quedan atascados los buscadores y la monitorización?
¿Qué pasa con la cola si cae un nodo del clúster durante el evento?
Esté listo para el minuto que decide el trimestre
Techo de concurrencia, puerta de llegada y una cola con su marca — configurados por servicio y dimensionados en modo observación antes del evento. Montémoslo sobre su propio tráfico.