기계 번역으로 제공되는 번역입니다. 제공된 번역과 원본 영어의 내용이 상충하는 경우에는 영어 버전이 우선합니다.
RUNNABLE 상태에서 정체된 작업
가 대기열의 전면을 차단하는 RUNNABLE 작업이 있음을 AWS Batch 감지하면 이유와 함께 서비스 작업 대기열 차단 이벤트에서를 수신합니다. 동일한 이유가 ListServiceJobs 및 DescribeServiceJob API 호출의 일부로 statusReason 필드에도 업데이트됩니다.
선택적으로 CreateJobQueue 및 UpdateJobQueue API 작업을 통해 jobStateTimeLimitActions 파라미터를 구성할 수 있습니다. jobStateTimeLimitActions 파라미터는가 AWS Batch 특정 상태의 작업에 대해 수행하는 작업 세트를 지정합니다. maxTimeSeconds 필드를 통해 초 단위로 시간 임곗값을 설정할 수 있습니다.
SAGEMAKER_TRAINING 서비스 환경에 연결된 작업 대기열의 경우에서 사용할 수 있는 유일한 작업은 작업을 종료TERMINATE하는 jobStateTimeLimitActions.action입니다.
예를 들어, 충분한 용량을 사용할 수 있을 때까지 대기 중인 RUNNABLE 상태의 모든 작업이 최대 4시간 동안 대기하도록 jobStateTimeLimitActions 파라미터를 설정할 수 있습니다. 작업을 종료CAPACITY:INSUFFICIENT_INSTANCE_CAPACITY하고 다음 작업이 작업 대기열의 헤드reason로 진행되도록 하기 전에 maxTimeSeconds를 로 설정하고를 14400으로 설정하여이 작업을 수행할 수 있습니다.
다음 섹션에서는 각각가 추론할 AWS Batch 수 있는 차단된 이유의 고유한 유형을 설명합니다. 각 섹션에는 다음이 포함됩니다.
-
ListServiceJobs및DescribeServiceJobAPI 작업에statusReason설정된 입니다. -
jobStateTimeLimitActions구성reason값입니다. -
가 종료를
jobStateTimeLimitActions트리거하면가statusReason표시됩니다.