本文為英文版的機器翻譯版本,如內容有任何歧義或不一致之處,概以英文版為準。
任務因容量而卡在 RUNNABLE 中
- 執行個體容量不足
-
所有連線的運算環境都有容量不足的錯誤。請求時, AWS Batch 會偵測遇到容量不足錯誤的 Amazon EC2 執行個體。手動取消任務將允許後續任務移至佇列的前端。
-
statusReason任務停滯時的訊息:CAPACITY:INSUFFICIENT_INSTANCE_CAPACITY - Service cannot fulfill the capacity requested for instance type [instanceTypeName] -
reason用於jobStateTimeLimitActions:CAPACITY:INSUFFICIENT_INSTANCE_CAPACITY -
statusReason在 取消任務之後的訊息jobStateTimeLimitActions:Canceled by JobStateTimeLimit action due to reason: CAPACITY:INSUFFICIENT_INSTANCE_CAPACITY
請注意:
-
AWS Batch 服務角色需要
autoscaling:DescribeScalingActivities許可,此偵測才能運作。如果您使用使用 的服務連結角色 AWS Batch服務連結角色 (SLR) 或 AWS 受管政策:AWSBatchServiceRole 政策受管政策,則不需要採取任何動作,因為其許可政策已更新。 -
如果您使用 SLR 或 受管政策,則必須新增
autoscaling:DescribeScalingActivities和ec2:DescribeSpotFleetRequestHistory許可,以便在 中接收封鎖的任務佇列事件和更新的任務狀態RUNNABLE。此外, AWS Batch 需要這些許可,才能透過jobStateTimeLimitActions參數執行cancellation動作,即使它們是在任務佇列上設定。 -
如果是多節點平行 (MNP) 任務,如果連接的高優先順序 Amazon EC2 運算環境發生錯誤
insufficient capacity,即使較低優先順序的運算環境確實遇到此錯誤,也會封鎖佇列。
-