View a markdown version of this page

Buat grup simpul komputasi untuk node login di AWS PCS - AWS PCS

Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.

Buat grup simpul komputasi untuk node login di AWS PCS

Grup node komputasi adalah kumpulan virtual node komputasi (instans EC2) yang diluncurkan dan dikelola AWS PCS. Saat menentukan grup simpul komputasi, Anda menentukan sifat umum seperti jenis instans EC2, jumlah instans minimum dan maksimum, subnet VPC target, opsi pembelian pilihan, dan konfigurasi peluncuran kustom. AWS PCS secara efisien meluncurkan, mengelola, dan mengakhiri node komputasi dalam grup simpul komputasi, sesuai dengan pengaturan ini.

Pada langkah ini, Anda akan meluncurkan grup simpul komputasi statis yang menyediakan akses interaktif ke cluster. Anda dapat menggunakan SSH atau Amazon EC2 Systems Manager (SSM) untuk masuk ke dalamnya, kemudian menjalankan perintah shell dan mengelola pekerjaan Slurm.

Untuk membuat grup simpul komputasi
  • Buka konsol AWS PCS dan arahkan ke Cluster.

  • Pilih cluster bernama get-started

  • Arahkan ke Compute node groups dan pilih Cre ate.

  • Di bagian pengaturan grup simpul komputasi, berikan yang berikut ini:

    • Hitung nama grup simpul — Masukkanlogin.

  • Di bawah konfigurasi komputasi, masukkan atau pilih nilai-nilai ini:

    • Template peluncuran EC2 - Pilih template peluncuran di mana namanya login-getstarted-lt

    • Profil instans IAM — Pilih profil instance bernama AWSPCS-getstarted-role

    • Subnet — Pilih subnet tempat nama dimulai. hpc-networking:PublicSubnetA Node login berjalan di subnet publik sehingga Anda dapat menjangkau mereka untuk masuk dan mengirimkan pekerjaan.

    • Inst ans — Pilihc6i.xlarge.

    • Konfigurasi penskalaan Untuk Min. jumlah instans, masukkan1. Untuk Maks. jumlah instans, masukkan1. Memperbaiki kedua hitungan 1 pada membuat satu node login berjalan setiap saat sebagai titik masuk yang stabil ke cluster.

  • Di bawah Pengaturan tambahan, tentukan yang berikut:

    • AMI ID — Pilih AMI yang ingin Anda gunakan, yang memiliki nama dalam format berikut:

      aws-pcs-sample_ami-al2023-platform-slurm-version
      catatan

      Contoh AMI untuk Slurm 25.05 dan versi sebelumnya menggunakan Amazon Linux 2 (amzn2) alih-alih Amazon Linux 2023 (). al2023

      Untuk informasi selengkapnya tentang AMI sampel, lihatMenggunakan sampel Amazon Machine Images (AMI) dengan AWS PCS.

  • Di bagian T indakan siklus hidup Node, tambahkan skrip yang memasang penyimpanan bersama dan meneruskan log simpul. Pilih Tambah skrip untuk setiap tindakan berikut. Skrip berjalan dari atas ke bawah dalam tahap, jadi tambahkan dalam urutan yang ditunjukkan. Untuk informasi selengkapnya tentang skrip yang dikelola AWS, lihatAWS-skrip yang dipelihara.

    1. configure-cloudwatch-logs — Meneruskan log tindakan siklus hidup setiap node ke Amazon Logs. CloudWatch Konfigurasikan terlebih dahulu sehingga tindakan berikut memiliki output yang ditangkap dari boot pertama node.

      • Tahap siklus hidup — PilihnodeBootstrapped.

      • Lokasi skrip — Masukkans3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/configure-cloudwatch-logs-v1-latest.sh, ganti region dengan Wil AWS ayah cluster Anda.

      • Nama — Masukkanconfigure-cloudwatch-logs.

      • Argum en — Biarkan bidang ini kosong. Script secara otomatis mengirimkan log ke grup /aws/pcs/cluster-id/lifecycle log.

      • Perilaku penanganan kesalahan — PilihCONTINUE.

      • Kebijakan eksekusi — PilihFIRST_BOOT_ONLY.

    2. configure-efs-homes — Memasang sistem file Amazon EFS sebagai basis direktori home di /home dan mengonfigurasi node untuk membuat direktori home setiap pengguna pada login pertama.

      • Tahap siklus hidup — PilihnodeBootstrapped.

      • Lokasi skrip — Masukkans3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/configure-efs-homes-v1-latest.sh, ganti region dengan Wil AWS ayah cluster Anda.

      • Nama — Masukkanconfigure-efs-homes.

      • Argumen — Masukkan--efs-id efs-file-system-id --home-base /home --options tls, ganti efs-file-system-id dengan ID sistem file EFS yang Anda buat sebelumnya dalam tutorial.

      • Perilaku penanganan kesalahan — PilihCONTINUE.

      • Kebijakan eksekusi — PilihEVERY_BOOT.

    3. mount-fsx-lustre — Pasang sistem file FSx for Lustre di untuk penyimpanan awal bersama berkinerja tinggi. /shared

      • Tahap siklus hidup — PilihnodeBootstrapped.

      • Lokasi skrip — Masukkans3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/mount-fsx-lustre-v1-latest.sh, ganti region dengan Wil AWS ayah cluster Anda (misalnya,us-east-1).

      • Nama — Masukkanmount-fsx-lustre.

      • Argumen — Masukkan--fsx-dns-name fsx-dns-name --mount-name mount-name --mount-point /shared, ganti fsx-dns-name dengan nama DNS dan mount-name dengan nama Mount yang Anda catat saat membuat FSx untuk sistem file Lustre.

      • Perilaku penanganan kesalahan — PilihCONTINUE.

      • Kebijakan eksekusi — PilihEVERY_BOOT.

    4. set-shared-dir-mode - Mengatur /shared ke izin (mode1777) yang dapat ditulis di seluruh dunia, sehingga setiap pengguna dapat membuat file di dalamnya. Ini berjalan set mount-fsx-lustre elahnya sehingga berlaku untuk sistem file yang dipasang.

      • Tahap siklus hidup — PilihnodeBootstrapped.

      • Lokasi skrip — Masukkanhttps://aws-hpc-recipes.s3.us-east-1.amazonaws.com/main/recipes/pcs-scripts/open_shared_dir/assets/set-shared-dir-mode-v1.0.0.sh. Skrip komunitas ini diterbitkan oleh HPC Recipes for AWS.

      • Nama — Masukkanset-shared-dir-mode.

      • Argum en — Masukkan--path /shared --mode 1777.

      • Perilaku penanganan kesalahan — PilihCONTINUE.

      • Kebijakan eksekusi — PilihEVERY_BOOT.

  • Pilih Buat grup simpul komputasi.

Bid ang Status menunjukkan Membuat saat grup simpul komputasi sedang disediakan. Anda dapat melanjutkan ke langkah berikutnya dalam tutorial saat sedang berlangsung.