

Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.

# Memperbarui versi penjadwal cluster di AWS PCS
<a name="working-with_clusters_version_update"></a>

AWS PCS memungkinkan Anda memperbarui versi penjadwal pada cluster yang ada tanpa membangun kembali infrastruktur Anda. Pembaruan versi memindahkan pengontrol cluster ke versi utama Slurm yang lebih baru, memberi Anda akses ke fitur baru, peningkatan kinerja, dan patch keamanan. Versi yang lebih baru juga memiliki masa pakai dukungan yang lebih lama sebelum mencapai akhir masa pakai.

## Gambaran umum
<a name="version_update-cluster-overview"></a>

Pembaruan versi penjadwal melibatkan tiga operasi:

1. **Siapkan AMI target ** — Buat atau identifikasi AMI yang menyertakan versi Slurm target dan agen AWS PCS terbaru.

1. **Perbarui cluster ** (`UpdateCluster`) - Memindahkan pengontrol ke versi utama Slurm target.

1. **Perbarui grup simpul kom ** put `UpdateComputeNodeGroup` asi () — Arahkan setiap grup simpul komputasi ke AMI baru sehingga node baru menggunakan versi target. Untuk informasi selengkapnya, lihat [Memperbarui sebuah AWS Grup node komputasi PCS](working-with_cng_update.md).

Ada dua jalan yang bisa Anda ikuti. Pilih opsi berdasarkan apakah Anda dapat mentolerir gangguan pekerjaan.

Terlepas dari opsi mana yang Anda pilih, sebelum proses dimulai, semua node dalam cluster harus menjalankan versi yang sama “A” dan pada akhir proses semua node harus menjalankan versi yang sama “B”. Opsi 2 berfungsi terlepas dari konfigurasi cluster Anda.


|  | Opsi 1: Pembaruan bergulir | Opsi 2: berhenti Full-fleet pemeliharaan | 
| --- | --- | --- | 
| Lowongan kerja  | Tidak memerlukan penghentian pekerjaan | Semua pekerjaan yang sedang berjalan dihentikan | 
| Versi pengontrol cluster minimum  | 24.05 | Tidak ada batasan | 
| Hitung armada setelah pembaruan pengontrol  | Versi campuran sementara; langkah-langkah pengeringan diperlukan. Kami merekomendasikan meminimalkan jumlah waktu selama versi campuran digunakan dalam cluster. | Semua node mulai segar pada versi target | 

**catatan**  
Sebelum memulai, pastikan semua node komputasi berada di patch terbaru Slurm versi A dan pada agen PCS terbaru AWS .

## Batasan
<a name="version_update-cluster-limitations"></a>

Jika cluster Anda menggunakan plugin Spank (konfigurasi plugstack), AWS PCS tidak mendukung Opsi 1. Pembaruan bergulir dapat menyebabkan ketidakcocokan versi konfigurasi plugstack dan kegagalan plugin.

## Kompatibilitas versi
<a name="version_update-cluster-compatibility"></a>

Tabel berikut menunjukkan versi target yang didukung untuk diperbarui, tergantung pada versi cluster saat ini. Selalu disarankan untuk meningkatkan ke versi terbaru yang diizinkan (ditampilkan dalam huruf tebal).

Cluster dan semua node komputasi harus selalu menjalankan versi Slurm yang sama sebelum memulai pembaruan.


| Versi cluster saat ini | Versi target yang kompatibel | 
| --- | --- | 
| 25.11 | N/A | 
| 25.05 | 25.11  | 
| 24.11 (EOL) | 25.11, 25.05 | 
| 24.05 (EOL) | 25.11, 25.05, 24.11 | 
| 23,11 (EOL) | (hanya melalui Opsi 2)  25.05, 24.11, 24.05 | 

Untuk informasi selengkapnya tentang versi yang didukung dan tanggal akhir masa pakai, lihat. [Versi slurm di AWS PCS](slurm-versions.md)

Anda tidak dapat melewati lebih dari tiga versi utama dalam satu pembaruan. Jika versi target Anda lebih dari tiga versi utama di depan versi Anda saat ini, lakukan pembaruan dalam beberapa langkah berturut-turut. Untuk contoh multi-langkah, lihat[Contoh: Memperbarui di beberapa versi](working-with_clusters_version_update_procedure.md#version_update-procedure-multi-hop).

## Dampak pada pekerjaan yang sedang berjalan
<a name="version_update-cluster-job-impact"></a>

Selama pembaruan, pengontrol Slurm sebentar tidak tersedia. Ini memiliki efek sebagai berikut:
+ **Menjalankan pekerjaan ** — Untuk Opsi 1 (pembaruan bergulir), pekerjaan yang sudah berjalan pada node komputasi terus dijalankan. Node komputasi tidak memerlukan pengontrol untuk tersedia untuk eksekusi pekerjaan aktif. Untuk Opsi 2 (penghentian pemeliharaan armada penuh), semua pekerjaan yang sedang berjalan dihentikan ketika armada diperkecil.
+ **Pengiriman pekerjaan baru ** — Anda tidak dapat mengirimkan pekerjaan baru atau menjalankan perintah penjadwal saat pengontrol tidak tersedia.
+ **Penskalaan ** — Penskalaan otomatis dijeda selama pembaruan. Tidak ada instans baru yang diluncurkan dan tidak ada instans yang dihentikan untuk penurunan skala hingga pembaruan selesai.
+ **Data akuntansi ** — Jika akuntansi diaktifkan, data akuntansi disimpan di seluruh pembaruan. Catatan pekerjaan yang disimpan dalam database akuntansi tetap ada setelah perubahan versi.
+ **Slurm REST API ** — Jika Slurm REST API diaktifkan pada cluster, secara otomatis diperbarui ke versi penjadwal baru sebagai bagian dari operasi. `UpdateCluster` Titik akhir REST API tidak tersedia selama pembaruan dan dilanjutkan ketika cluster kembali ke `ACTIVE` status. Untuk informasi selengkapnya, lihat [Slurm REST API di AWS PCS](slurm-rest-api.md).

## Menggabungkan pembaruan versi dengan perubahan konfigurasi
<a name="version_update-cluster-combined-changes"></a>

Anda dapat menggabungkan pembaruan versi dengan perubahan konfigurasi lainnya dalam satu `UpdateCluster` permintaan. Misalnya, Anda dapat memperbarui versi penjadwal dan mengaktifkan akuntansi dalam operasi yang sama.

**catatan**  
Jangan menambahkan pengaturan Slurm khusus untuk versi target sementara armada masih berisi node pada versi sebelumnya. Konfigurasi didistribusikan ke semua node; yang lama `slurmd` mungkin tidak mengenali parameter baru.

**Topics**
+ [Gambaran umum](#version_update-cluster-overview)
+ [Batasan](#version_update-cluster-limitations)
+ [Kompatibilitas versi](#version_update-cluster-compatibility)
+ [Dampak pada pekerjaan yang sedang berjalan](#version_update-cluster-job-impact)
+ [Menggabungkan pembaruan versi dengan perubahan konfigurasi](#version_update-cluster-combined-changes)
+ [Perbarui versi penjadwal dari AWS Cluster PCS](working-with_clusters_version_update_procedure.md)
+ [Pemecahan Masalah AWS Pembaruan versi cluster PCS](working-with_clusters_version_update_troubleshooting.md)