View a markdown version of this page

Cuotas de servicio y limitaciones para Deadline Cloud - AWS Deadline Cloud

Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.

Cuotas de servicio y limitaciones para Deadline Cloud

AWS Deadline Cloud proporciona recursos, como granjas, flotas y colas, que puede usar para procesar trabajos. Cuando creas el tuyo Cuenta de AWS, establecemos cuotas predeterminadas de estos recursos para cada uno de ellos. Región de AWS Deadline Cloud también limita la tasa de solicitudes de API. Para obtener más información, consulte Limitación de solicitudes de la API.

Service Quotas es una ubicación central en la que puedes ver y gestionar tus cuotas Servicios de AWS. También puedes solicitar un aumento de cuota para muchos de los recursos que utilizas.

Para ver las cuotas Deadline Cloud, abre la consola de cuotas de servicio. En el panel de navegación, seleccione los Servicios de AWS y elija Deadline Cloud.

Para solicitar un aumento de cuota, consulte Solicitud de un aumento de cuota en la Guía de usuario de Service Quotas. Si la cuota aún no está disponible en las cuotas de servicio, utilice el formulario de aumento de cuotas de servicio.

Tu AWS cuenta tiene relacionadas con las siguientes cuotas Deadline Cloud.

Las cuotas de miembros asociadas cuentan las membresías que asignas a una granja, una flota, una cola o un trabajo. Cada concesión de usuario y cada concesión de grupo cuenta como una membresía, por lo que un grupo cuenta como un miembro independientemente del número de usuarios que contenga. Deadline Cloud no limita el número de usuarios de un grupo ni el número de grupos a los que pertenece un usuario; en su lugar, AWS IAM Identity Center se aplican las cuotas. Para conceder acceso a más usuarios dentro de la cuota de miembros, asigna grupos en lugar de usuarios individuales. Para obtener más información, consulte Cómo funcionan los permisos en Deadline Cloud.

Compute para flotas administradas por servicios se toma en cuenta en función de las cuotas de Deadline Cloud vCPU y GPU de la tabla siguiente, no de las cuotas de servicio de Amazon Elastic Compute Cloud (Amazon EC2). Para obtener más información, consulte Cuotas para servicios relacionados.

La siguiente tabla incluye las cuotas para los volúmenes de almacenamiento persistente utilizados por las flotas administradas por servicios. Para obtener más información sobre el almacenamiento persistente, consulte. Almacenamiento persistente para flotas administradas por servicios

Name Predeterminado Ajustable Description (Descripción)
Miembros asociados por granja Cada región admitida: 75 No El número máximo de usuarios principales (usuarios o grupos) que se pueden asociar a cada granja de la AWS región actual. Cada grupo asociado cuenta como un miembro, independientemente del número de usuarios que contenga.
Miembros asociados por flota Cada región admitida: 75 No El número máximo de usuarios principales (usuarios o grupos) que se pueden asociar a cada flota en la AWS región actual. Cada grupo asociado cuenta como un miembro, independientemente del número de usuarios que contenga.
Miembros asociados por trabajo Cada región admitida: 75 No El número máximo de directores (usuarios o grupos) que se pueden asociar a cada trabajo en la AWS región actual. Cada grupo asociado cuenta como un miembro, independientemente del número de usuarios que contenga.
Miembros asociados por cola Cada región admitida: 75 No El número máximo de usuarios principales (usuarios o grupos) que se pueden asociar a cada cola de la región actual AWS . Cada grupo asociado cuenta como un miembro, independientemente del número de usuarios que contenga.
Cuotas por explotación Cada región admitida: 20 El número máximo de presupuestos por granja en la AWS región actual
Granjas por región Cada región admitida: 2 El número máximo de granjas que se pueden crear en la AWS región actual.
Flotas por explotación Cada región admitida: 5 El número máximo de flotas que se pueden crear para cada granja de la AWS región actual.
Puestos de trabajo por explotación Cada región admitida: 100 000 El número máximo de empleos por granja en la AWS región actual.
Puntos finales de licencia por región Cada región admitida: 5 El número máximo de terminales de licencia en la AWS región actual.
Sesiones de licencia por punto de conexión de licencia Cada región admitida: 500 El número máximo de sesiones de licencia por punto final de licencia en la AWS región actual.
Límites por explotación Cada región admitida: 50 La cantidad máxima de límites que se pueden crear para cada granja de la AWS región actual.
Monitores por región Cada región admitida: 1 No El número máximo de monitores de la AWS región actual.
OnDemand GPU de instancia G por región Cada región admitida: 0 La cantidad máxima de GPU de instancias G bajo demanda que se pueden aprovisionar en todas las flotas administradas por servicios de la región actual. AWS
OnDemand CPU virtuales por región Cada región admitida: 50 La cantidad máxima de vCPU bajo demanda que se pueden aprovisionar en todas las flotas administradas por servicios de la región actual. AWS
Entornos de cola por cola Cada región admitida: 10 No La cantidad máxima de entornos de cola que se pueden crear para cada cola en la región actual. AWS
Coloque en cola las asociaciones de flotas por granja Cada región admitida: 100 El número máximo de asociaciones de flotas en cola por granja en la región actual AWS
Limita las asociaciones de colas por cola Cada región admitida: 10 El número máximo de límites que se pueden asociar a cada cola en la región actual AWS .
Colas por explotación Cada región admitida: 20 El número máximo de colas que se pueden crear para cada granja de la región actual AWS .
Configuraciones de recursos por flota Cada región admitida: 1 La cantidad máxima de configuraciones de recursos de VCs Lattice que se pueden agregar a cada flota.
GPU de instancia G puntual por región Cada región admitida: 0 La cantidad máxima de GPU de instancias puntuales G que se pueden aprovisionar en todas las flotas administradas por servicios de la región actual. AWS
VCPUs de spot por región Cada región admitida: 50 La cantidad máxima de vCPU puntuales que se pueden aprovisionar en todas las flotas administradas por servicios de la región actual. AWS
Paso a paso: consumidores Cada región admitida: 32 El número máximo de pasos por los que se puede declarar una dependencia (consumir) un solo paso dentro de un trabajo en la AWS región actual.
Dependencias de pasos por paso Cada región admitida: 128 El número máximo de pasos de los que un solo paso de un trabajo puede declarar una dependencia en la AWS región actual.
Pasos por tarea Cada región admitida: 200 El número máximo de pasos por trabajo en la AWS región actual.
Almacenamiento de volúmenes de SSD de uso general (gp3), en TiB Cada región admitida: 1 La cantidad máxima agregada de almacenamiento de EBS, medida en TiB, que se puede usar en todas las flotas de la región actual. AWS
Almacenamiento para volúmenes persistentes de SSD de uso general (gp3), en TiB Cada región admitida: 4 La cantidad máxima agregada de almacenamiento, en TiB, que se puede aprovisionar en los volúmenes persistentes de SSD de uso general (gp3) en la región actual. AWS
Perfiles de almacenamiento por explotación Cada región admitida: 50 No La cantidad máxima de perfiles de almacenamiento que se pueden crear para cada granja de la región actual. AWS
Tareas por bloque Cada región admitida: 150 No El número máximo de tareas que se pueden combinar en un solo fragmento al enviar un trabajo.
Tareas por trabajo Cada región admitida: 10 000 El número máximo de tareas por trabajo en la AWS región actual.
Tareas por paso Cada región admitida: 10 000 El número máximo de tareas por paso en la AWS región actual.
Wait-and-save CPU virtuales por región Cada región admitida: 50 La cantidad máxima de vCPU virtuales de espera y ahorro que se pueden aprovisionar en todas las flotas administradas por servicios de la región actual. AWS
Trabajadores por explotación Cada región compatible: 7500 El número máximo de trabajadores por granja en la AWS región actual.

Limitación de solicitudes de la API

Deadline Cloud limita la tasa de solicitudes de API para cada uno Cuenta de AWS de ellos Región de AWS. Las tasas de solicitud predeterminadas admiten cargas de trabajo y uso a gran escala. Cuando sus solicitudes superen la velocidad permitida, Deadline Cloud rechace la solicitud con un código de estado HTTP 429 y un ThrottlingException error.

Los AWS SDK y los que AWS CLI se reintentan automáticamente limitan las solicitudes mediante un retraso exponencial. La limitación ocasional se resuelve sin necesidad de realizar cambios en la aplicación. Si experimenta una limitación sostenida, póngase en contacto con el equipo de AWS soporte para solicitar tasas de solicitud más altas.

Algunas Deadline Cloud funciones utilizan otras Servicios de AWS, y también se aplican las cuotas de esos servicios.

Cuotas de Amazon EC2 para flotas administradas por clientes

Sus cuotas de Amazon Elastic Compute Cloud (Amazon EC2) se aplican a las flotas administradas por los clientes, ya que esos trabajadores trabajan en instancias de su propia cuenta. En cambio, la computación para las flotas administradas por servicios se descuenta de las cuotas de Deadline Cloud vCPU y GPU de la tabla anterior.

Para ver o aumentar sus cuotas de Amazon EC2, abra la consola de cuotas de servicio y seleccione Amazon Elastic Compute Cloud. Para obtener más información, consulte Cuotas de servicio de Amazon EC2 en la Guía del usuario de Amazon EC2.

Cuotas de Amazon Bedrock para el Deadline Cloud asistente

Asistente Deadline CloudUtiliza la inferencia bajo demanda de Amazon Bedrock en su cuenta Cuenta de AWS, por lo que se aplican las cuotas de servicio de Amazon Bedrock. Las dos restricciones principales son:

  • Solicitudes por minuto (RPM): la cantidad de solicitudes de invocación del modelo permitidas por minuto.

  • Tokens por minuto (TPM): el número total de tokens de entrada y salida procesados por minuto.

Las cuotas predeterminadas varían según la región. Algunas regiones tienen límites predeterminados más bajos, de hasta 20 RPM, lo que puede provocar una ralentización si se utiliza mucho el asistente. El asistente usa perfiles de inferencia interregionales, que admiten un mínimo de 200 RPM. Cross-regionLa inferencia puede ayudar a reducir las limitaciones en las regiones con límites más bajos para una sola región. Si tu región utiliza la inferencia interregional, también se aplican las cuotas de servicio en las regiones de destino.

Si experimenta errores de limitación al utilizar el asistente, puede solicitar un aumento de la cuota de servicio de Amazon Bedrock:

Cómo solicitar un aumento de cuota
  1. Abra la consola de Service Quotas.

  2. En el panel de navegación, elige AWS servicios y, a continuación, Amazon Bedrock.

  3. Busque la cuota del modelo utilizado por el asistente (busque las cuotas InvokeModelWithResponseStream relacionadas con el modelo correspondiente).

  4. Elige el nombre de la cuota y, a continuación, selecciona Solicitar aumento a nivel de cuenta.

  5. Introduce el valor de cuota deseado y envía la solicitud.

Puede supervisar el uso de su cuota de Amazon Bedrock a través de CloudWatch las métricas. Configure CloudWatch alarmas en Amazon Bedrock limitando las métricas para identificar cuándo se acerca a sus límites de cuota. Para obtener más información, consulte Monitorización de Amazon Bedrock en la guía del usuario de Amazon Bedrock.