View a markdown version of this page

RUNNABLE 상태에서 정체된 작업 - AWS Batch

기계 번역으로 제공되는 번역입니다. 제공된 번역과 원본 영어의 내용이 상충하는 경우에는 영어 버전이 우선합니다.

RUNNABLE 상태에서 정체된 작업

가 대기열의 전면을 차단하는 RUNNABLE 작업이 있음을 AWS Batch 감지하면 이유와 함께 서비스 작업 대기열 차단 이벤트에서를 수신합니다. 동일한 이유가 ListServiceJobsDescribeServiceJob API 호출의 일부로 statusReason 필드에도 업데이트됩니다.

선택적으로 CreateJobQueueUpdateJobQueue API 작업을 통해 jobStateTimeLimitActions 파라미터를 구성할 수 있습니다. jobStateTimeLimitActions 파라미터는가 AWS Batch 특정 상태의 작업에 대해 수행하는 작업 세트를 지정합니다. maxTimeSeconds 필드를 통해 초 단위로 시간 임곗값을 설정할 수 있습니다.

SAGEMAKER_TRAINING 서비스 환경에 연결된 작업 대기열의 경우에서 사용할 수 있는 유일한 작업은 작업을 종료TERMINATE하는 jobStateTimeLimitActions.action입니다.

예를 들어, 충분한 용량을 사용할 수 있을 때까지 대기 중인 RUNNABLE 상태의 모든 작업이 최대 4시간 동안 대기하도록 jobStateTimeLimitActions 파라미터를 설정할 수 있습니다. 작업을 종료CAPACITY:INSUFFICIENT_INSTANCE_CAPACITY하고 다음 작업이 작업 대기열의 헤드reason로 진행되도록 하기 전에 maxTimeSeconds를 로 설정하고를 14400으로 설정하여이 작업을 수행할 수 있습니다.

다음 섹션에서는 각각가 추론할 AWS Batch 수 있는 차단된 이유의 고유한 유형을 설명합니다. 각 섹션에는 다음이 포함됩니다.

  • ListServiceJobsDescribeServiceJob API 작업에 statusReason 설정된 입니다.

  • jobStateTimeLimitActions 구성 reason 값입니다.

  • 가 종료를 jobStateTimeLimitActions 트리거하면가 statusReason 표시됩니다.