Saltar al contenido principal
Capacidad

Sala de espera

Cuando la multitud es mayor que la aplicación, la cola debe estar delante — ordenada, justa y con un número que el visitante ve de verdad.

TR7 Waiting Room admite visitantes al ritmo que su aplicación puede servir y mantiene al resto en una cola ordenada sobre la plataforma de entrega. Dos techos hacen el trabajo: cuántos visitantes pueden estar dentro a la vez y con qué rapidez pueden entrar los nuevos. Todo lo demás — la página con su marca, la posición, el tiempo estimado, la exención de los buscadores verificados — existe para que la cola sea algo que se soporta y no algo que se abandona.

Por servicio
Cada servicio publicado tiene su propio techo y su propia página de espera
0
Líneas de código de la aplicación modificadas para poner una cola delante
Observación
Modo que dimensiona la cola antes del evento en lugar de durante él

Un día de lanzamiento no falla despacio. Falla de golpe.

La planificación de capacidad supone que el tráfico llega a un ritmo. La apertura de la venta, el lanzamiento de una campaña, los resultados de un examen o la apertura de citas no llegan a un ritmo: llegan en un instante. La aplicación tampoco se degrada con educación: el pool de conexiones se llena, la base de datos se encola, los tiempos de respuesta suben y los usuarios recargan, lo que duplica la carga que causó el problema.

Las respuestas habituales lo empeoran. El autoescalado añade instancias cuando el pico ya ha caído y la base de datos ya es el cuello de botella. La limitación de velocidad rechaza peticiones — algo que, para quien hace cola por una entrada de concierto, es indistinguible de un sitio roto. Ambas dejan la misma impresión: en el momento en que más quería estar listo, no lo estaba.

Una sala de espera cambia la forma del problema. A la multitud no se la rechaza ni se la descarta: se la ordena. La aplicación sirve el número que sirve bien, el resto guarda un sitio con posición y estimación, y la plataforma admite al siguiente en cuanto se libera un lugar.

Nuestro enfoque

La cola se ejecuta en la plataforma de entrega, delante de la aplicación, de modo que sigue en pie cuando la aplicación ya está al límite — y ninguna línea de código de la aplicación participa en admitir, retener o liberar a nadie.

Un techo que la aplicación realmente puede servir

Fije el número máximo de visitantes admitidos a la vez en un servicio publicado. Ese número sale de lo que la aplicación demuestra soportar bien, no de lo que el hardware podría dejar pasar en teoría.

Una puerta al ritmo de llegada, no solo al tamaño de la multitud

Un techo aparte limita cuántos visitantes nuevos pueden entrar por minuto. Es lo que protege a un backend que aguanta una población grande y estable pero se derrumba cuando diez mil personas llegan en el mismo segundo.

Modo observación — la capacidad se encuentra antes del evento

Ejecute la sala de espera en modo observación y contará lo que habría pasado sin retener a nadie. Dimensiona la cola con su propio tráfico, en un día normal, y llega al evento con un número en el que confía en vez de uno que adivinó.

Los bots verificados no ocupan sitio en la cola

Los buscadores verificados y las sondas de monitorización se reconocen y quedan exentos: la indexación y las comprobaciones de disponibilidad continúan durante el evento y no se gasta ningún sitio en tráfico que no iba a comprar nada.

Capacidades

Todo lo siguiente se configura por servicio publicado, en la misma pantalla que el resto de la política de tráfico, y cada cambio surte efecto por recarga en caliente — incluso durante el evento.

Máximo de visitantes simultáneos, por servicio publicado

Cada aplicación tiene sus límites y un mismo equipo puede ejecutar una sala de espera distinta para cada una al mismo tiempo. El techo es una propiedad del servicio, no de la caja.

Nuevos visitantes por minuto — protección ante picos

La puerta de llegada es independiente del techo de concurrencia. Un pool cómodo con 20.000 personas dentro puede destruirse igualmente si 20.000 llegan de golpe; este control separa ambos casos.

Páginas de espera condicionales — solo donde importa

La cola se aplica por condición: las rutas de pago y de entradas quedan protegidas mientras el catálogo, la ayuda y la página de estado siguen abiertos. El visitante espera por lo escaso, no por todo el sitio.

Posición y tiempo estimado, a la vista del visitante

Una cola sin número es indistinguible de una página colgada. La página de espera muestra dónde está el visitante y cuánto es probable que tarde: esa es la diferencia entre esperar e irse.

El sitio se conserva — recargar no lo cuesta

La posición va ligada a la sesión del visitante: recargar, perder la conexión o pasar de datos móviles a Wi-Fi no manda a nadie al final. Las tormentas de recarga dejan de ser un daño autoinfligido.

Su propia página de espera

La página es una plantilla que usted controla — su marca, su idioma, su mensaje — servida por la plataforma incluso cuando la aplicación detrás está totalmente ocupada.

Admisión en cuanto se libera un sitio

A medida que terminan las sesiones, los siguientes visitantes se liberan automáticamente. Nadie espera a un temporizador que ha dejado de corresponderse con la realidad.

Visibilidad en vivo durante el evento

Profundidad de la cola, admisiones por minuto, espera media y abandono están en pantalla mientras ocurre el evento: la decisión de subir o bajar el techo se toma con evidencia.

Profundidad operacional

Una sala de espera vale lo que valga su comportamiento en los casos incómodos: una conmutación en mitad del evento, una flota de bots en la cola, un visitante con conexión inestable.

01

La cola está en la plataforma, no en la aplicación

Sin agente, sin biblioteca, sin cambios de código y sin un servicio de colas que operar. La aplicación nunca se entera de que existe una sala de espera; simplemente no ve más tráfico del que puede servir.

02

Orden justo, ligado a la sesión

La admisión es por orden de llegada y la posición viaja con la sesión del visitante en vez de con una IP: un NAT corporativo, un CGNAT de operador o una línea de oficina compartida no ponen a todos uno detrás de otro.

03

Se combina con el resto de la protección

El scoring de bots se ejecuta antes de la cola, así que el tráfico automatizado se trata en lugar de encolarse. La limitación de velocidad sigue aplicándose a quien está dentro. La sala de espera gestiona a la multitud honesta; no se le pide ser un control de seguridad.

04

Sobrevive a una conmutación

El estado de la cola se replica en el clúster: la caída de un nodo durante una apertura de venta no reinicia la fila. El evento continúa en el nodo superviviente con las posiciones intactas.

05

Comportamiento al recargar, con pestañas nuevas y dispositivos compartidos

Una segunda pestaña se une al mismo sitio en lugar de ocupar otro. Hay reglas explícitas para la expiración de sesión y el abandono: los sitios que dejan los visitantes que se van vuelven a la cola.

06

Se activa y desactiva durante el evento

Toda la función es un cambio en caliente. Puede activarse minutos antes de la apertura y desactivarse en cuanto pasa el pico, sin perder una conexión ni reiniciar nada.

Cuándo usarlo

Aperturas de venta y ticketing

Conciertos, partidos y ventas de viajes concentran el tráfico de un año en noventa segundos. La sala de espera convierte un pico inservible en una fila ordenada y cada visitante conserva un sitio que puede ver.

Lanzamientos de producto y campañas

Una campaña que funciona es, en la capa de red, indistinguible de un ataque. La sala de espera permite que marketing tenga éxito sin pedir a la infraestructura que absorba todo ese éxito en un segundo.

Ventanas de solicitud en el sector público

Resultados de exámenes, plazos fiscales y apertura de citas se anuncian a toda una población con minuto exacto. Una cola con posición visible es además la respuesta más justa que se puede dar a la ciudadanía.

Picos de nómina y fin de mes en banca

Picos previsibles y repetidos no justifican dimensionar la plataforma de forma permanente para la peor hora del mes. La sala de espera cubre el pico y la plataforma sigue dimensionada para el día normal.

Preguntas frecuentes

¿En qué se diferencia de la limitación de velocidad?
La limitación rechaza peticiones por encima de un umbral; el visitante recibe un error y no sabe qué hacer. Una sala de espera acepta a todos y los ordena: nadie es rechazado, a cada uno se le dice dónde está y cuánto tardará aproximadamente. Ambas tienen su lugar y funcionan juntas: la limitación trata el abuso, la sala de espera trata la demanda legítima que simplemente es mayor que la aplicación.
¿Hay que cambiar la aplicación?
No. La cola se ejecuta en la plataforma de entrega delante de la aplicación: no hay biblioteca que integrar, agente que instalar ni servicio de colas que operar. La aplicación solo ve el tráfico ya admitido.
¿Cómo elegimos el número correcto de concurrencia?
Ejecute primero la sala de espera en modo observación. Cuenta, sobre su propio tráfico, lo que se habría encolado sin retener a nadie: así fija el techo con evidencia de una semana normal en vez de con una estimación hecha bajo presión el mismo día.
¿Qué pasa si un visitante recarga o pierde la conexión?
El sitio va ligado a la sesión, no a la petición: recargar, perder la conexión o cambiar de red conserva la posición. Importa más de lo que parece — sin eso, los visitantes inquietos recargan, la recarga multiplica la carga y la cola empieza a causar el problema que vino a evitar.
¿Se quedan atascados los buscadores y la monitorización?
No. Los buscadores verificados y las sondas de monitorización se reconocen y quedan exentos: la indexación y las comprobaciones de disponibilidad siguen con normalidad durante el evento y no consumen sitio.
¿Qué pasa con la cola si cae un nodo del clúster durante el evento?
El estado de la cola se replica en el clúster: el nodo superviviente continúa la misma fila con las posiciones intactas. Una conmutación en plena apertura de venta no se convierte en un segundo incidente.

Esté listo para el minuto que decide el trimestre

Techo de concurrencia, puerta de llegada y una cola con su marca — configurados por servicio y dimensionados en modo observación antes del evento. Montémoslo sobre su propio tráfico.