View a markdown version of this page

Prácticas recomendadas para el diseño de las políticas de escalado - Mejores prácticas para implementar WorkSpaces aplicaciones de Amazon

Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.

Prácticas recomendadas para el diseño de las políticas de escalado

Combinar políticas de escalado

Muchos clientes eligen combinar diferentes tipos de políticas de escalado en una sola flota para aumentar la potencia y la flexibilidad de Auto Scaling in WorkSpaces Applications. Por ejemplo, puede configurar una política de escalado programado para aumentar el mínimo de la flota a las 6:00 a.m. antes de que los usuarios comiencen su jornada laboral, y para reducir el mínimo de la flota a las 4:00 p.m., antes de que los usuarios dejen de trabajar. Puede combinar esta política de escalado programado con políticas de seguimiento de objetivos o escalonamiento gradual para mantener un nivel de utilización específico y reducir horizontalmente o aumentar horizontalmente durante el día para hacer frente a los picos de uso. La combinación de escalado programado y escalado de seguimiento de destino puede contribuir a reducir el impacto de un fuerte aumento de los niveles de utilización cuando se necesita capacidad inmediatamente.

Evite la rotación del escalado

Considere si su flota podría sufrir un alto grado de rotación debido a su caso de uso. La rotación se produce cuando un gran número de usuarios inician y, después, finalizan las sesiones en un período corto de tiempo. Esto puede ocurrir cuando muchos usuarios acceden a un aplicación simultáneamente de su flota durante solo unos minutos antes de cerrar sesión.

En estas situaciones, el tamaño de la flota puede quedar muy por debajo de la capacidad deseada, ya que las instancias finalizan cuando los usuarios cierran sus sesiones. Es posible que las políticas de escalonamiento gradual no agreguen instancias con la suficiente rapidez como para compensar la rotación y, como resultado, su flota se quede atascada en un tamaño determinado.

Puede identificar la pérdida de clientes examinando CloudWatch las métricas de su flota. Los períodos en los que su flota tiene una capacidad pendiente distinta de cero sin cambios (o con muy pocos cambios) en la capacidad deseada indican que es probable que se produzca una alta pérdida de clientes. Para tener en cuenta las situaciones de alta rotación, utilice políticas de seguimiento de escalado de los objetivos y elija un objetivo de utilización en que el (100 menos el porcentaje de utilización objetivo) supere la tasa de rotación en un período de 15 minutos. Por ejemplo, si el 10% de su flota se va a cerrar en un período de 15 minutos debido a la rotación de usuarios, establezca un objetivo de utilización de la capacidad del 90% o menos para compensar la alta rotación.

Comprenda la tasa máxima de aprovisionamiento

Los clientes que gestionan flotas de WorkSpaces aplicaciones para un gran número de usuarios deberían tener en cuenta los límites de velocidad de aprovisionamiento. Este límite afectará a la rapidez con la que se pueden añadir instancias a una flota o a todas las flotas dentro de una Cuenta de AWS.

Hay dos límites a tener en cuenta:

  • Para una sola flota, WorkSpaces Applications aprovisiona a una velocidad máxima de 20 instancias por minuto.

  • En el caso de una sola instancia Cuenta de AWS, WorkSpaces Applications aprovisiona a una velocidad de 60 instancias por minuto (con una ráfaga de 100 instancias por minuto).

Si se escalan verticalmente más de tres flotas en paralelo, el límite de velocidad de aprovisionamiento de cuentas se comparte entre estas flotas (por ejemplo, seis flotas escalando en paralelo podrían aprovisionar hasta 10 instancias por minuto cada una). Además, ten en cuenta el tiempo que tarda una determinada instancia de transmisión en finalizar el aprovisionamiento en respuesta a un evento de escalado. En el caso de las flotas que no están unidas a un dominio de Active Directory, suele tardar 15 minutos. En el caso de las flotas unidas a un dominio de Active Directory, esto puede tardar hasta 25 minutos.

Teniendo en cuenta estas restricciones, fíjese en los siguientes ejemplos:

  • Si desea ampliar una sola flota de 0 a 1000 instancias, el aprovisionamiento tardará 50 minutos (1000 instances/20 instancias por minuto) y, después, entre 15 y 25 minutos más hasta que todas las instancias estén disponibles para los usuarios finales, lo que supone un total de 65 a 75 minutos.

  • Si desea escalar tres flotas de 0 a 333 instancias de forma simultánea (para un total de 999 instancias Cuenta de AWS), todas las flotas tardarán aproximadamente 17 minutos (999/60instancias por minuto) en completar el aprovisionamiento y, después, 15 minutos adicionales para que esas instancias estén disponibles para los usuarios finales, lo que supone un total de 32 a 42 minutos.

Utilice varias zonas de disponibilidad

Elija varias zonas de disponibilidad en la región para la implementación de su flota. Al seleccionar varias zonas de disponibilidad para su flota, aumenta la probabilidad de que su flota pueda añadir instancias en respuesta a un evento de escalado. La CloudWatch métrica PendingCapacity es un punto de partida para evaluar qué tan optimizado está el diseño de zona de disponibilidad de una flota en despliegues de flotas grandes. Un valor alto y sostenido de PendingCapacity puede indicar la necesidad de ampliar el escalado horizontal (en todas las zonas de disponibilidad). Para obtener más información, consulte Supervisión de los recursos de Amazon WorkSpaces Applications.

Por ejemplo, si el escalado automático intenta aprovisionar instancias para aumentar el tamaño de la flota y la zona de disponibilidad seleccionada no tiene suficiente capacidad, el autoescalado añadirá instancias en las otras zonas de disponibilidad que haya especificado para su flota. Para obtener más información sobre las zonas de disponibilidad y el diseño de WorkSpaces las aplicaciones, consulte las zonas de disponibilidad en este documento.

Supervise las métricas del error de capacidad insuficiente

El «error de capacidad insuficiente» es una CloudWatch métrica para WorkSpaces las flotas de aplicaciones. Esta métrica especifica el número de solicitudes de sesión que se han rechazado por falta de capacidad.

Al realizar cambios en las políticas de escalado, resulta útil crear una CloudWatch alarma que le notifique si se produce algún error de capacidad insuficiente. Esto le permite ajustar sus políticas de escalado rápidamente para optimizar la disponibilidad para los usuarios. La guía de administración proporciona pasos detallados para monitorear los recursos de sus WorkSpaces aplicaciones.