

Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.

# Memecahkan masalah kegagalan pengiriman pekerjaan karena MaxJobCount batasan
<a name="troubleshooting-job-submission-maxjobcount"></a>

**Masalah: ** Pengiriman pekerjaan gagal dengan pesan kesalahan berikut:

```
sbatch: error: Slurm temporarily unable to accept job, sleeping and retrying
```

Kesalahan ini terjadi bahkan ketika jumlah pekerjaan yang sedang berjalan dan tertunda tampaknya jauh di bawah batas pekerjaan cluster.

**Penyebab: B ** atas mencakup `MaxJobCount` semua pekerjaan yang dilacak oleh Slurm, bukan hanya pekerjaan yang sedang berjalan atau tertunda. Pekerjaan yang telah selesai tetap berada di memori Slurm untuk jangka waktu tertentu (secara default, 5 menit) sebelum dibersihkan. Selama periode throughput pekerjaan yang tinggi, jumlah total pekerjaan aktif ditambah pekerjaan yang baru saja diselesaikan dapat melebihi batas.

Anda dapat memverifikasi jumlah pekerjaan total dengan menjalankan perintah berikut pada node cluster:

```
scontrol show jobs | grep -c JobId
```

Ini menunjukkan jumlah total pekerjaan yang dilacak Slurm, termasuk pekerjaan selesai menunggu pembersihan.

**Solusi: ** Pertimbangkan salah satu pendekatan berikut:
+ **Buat cluster yang lebih besar ** - Jika beban kerja Anda secara konsisten membutuhkan lebih banyak pekerjaan bersamaan, buat cluster baru dengan ukuran yang lebih besar. Untuk informasi selengkapnya tentang ukuran cluster dan batasnya, lihat[Ukuran cluster dalam AWS PCS](working-with_clusters_size.md).
+ **Kurangi tingkat pengiriman pekerjaan ** — Sesuaikan skrip pengiriman pekerjaan Anda untuk mengirimkan pekerjaan pada tingkat yang lebih lambat, memungkinkan waktu pekerjaan yang diselesaikan dibersihkan dari pelacakan Slurm.