View a markdown version of this page

AWS PCS でログインノードのコンピューティングノードグループを作成する - AWS PCS

翻訳は機械翻訳により提供されています。提供された翻訳内容と英語版の間で齟齬、不一致または矛盾がある場合、英語版が優先します。

AWS PCS でログインノードのコンピューティングノードグループを作成する

コンピューティングノードグループは、PCS が起動して管理するコンピューティングノード (EC2 インスタンス) AWS の仮想コレクションです。コンピューティングノードグループを定義するときは、EC2 インスタンスタイプ、最小インスタンス数と最大インスタンス数、ターゲット VPC サブネット、優先購入オプション、カスタム起動設定などの一般的な特性を指定します。 AWS PCS は、これらの設定に従って、コンピューティングノードグループ内のコンピューティングノードを効率的に起動、管理、終了します。

このステップでは、クラスターへのインタラクティブなアクセスを提供する静的コンピューティングノードグループを起動します。SSH または Amazon EC2 Systems Manager (SSM) を使用してログインし、シェルコマンドを実行して Slurm ジョブを管理できます。

コンピューティングノードグループを作成するには
  • AWS PCS コンソールを開き、クラスターに移動します。

  • という名前のクラスターを選択する get-started

  • Compute ノードグループに移動し、作成を選択します。

  • Compute ノードグループのセットアップセクションで、以下を指定します。

    • コンピューティングノードグループ名 – と入力しますlogin

  • コンピューティング設定で、次の値を入力または選択します。

    • EC2 起動テンプレート – 名前が である起動テンプレートを選択します。 login-getstarted-lt

    • IAM インスタンスプロファイル – という名前のインスタンスプロファイルを選択します。 AWSPCS-getstarted-role

    • サブネット – 名前が で始まるサブネットを選択しますhpc-networking:PublicSubnetA。ログインノードはパブリックサブネットで実行されるため、ログインして作業を送信できます。

    • インスタンス – を選択しますc6i.xlarge

    • スケーリング設定最小インスタンス数には、 と入力します1最大インスタンス数には、 と入力します1。両方のカウントを で修正すると1、クラスターへの安定したエントリポイントとして、1 つのログインノードが常に実行されます。

  • 追加設定で、以下を指定します。

    • AMI ID – 次の形式の名前を持つ、使用する AMI を選択します。

      aws-pcs-sample_ami-al2023-platform-slurm-version
      注記

      Slurm 25.05 以前のバージョンのサンプル AMIsAmazon Linux 2023 (amzn2) の代わりに Amazon Linux 2 () を使用しますal2023

      サンプル AMIs「」を参照してくださいPCS でのサンプル Amazon マシンイメージ (AMIs) AWS の使用

  • ノードライフサイクルアクションセクションで、共有ストレージをマウントしてノードログを転送するスクリプトを追加します。次の各アクションのスクリプトの追加を選択します。スクリプトはステージ内で上から下に実行されるため、表示されている順序で追加します。AWS が管理するスクリプトの詳細については、「」を参照してくださいAWSが管理するスクリプト

    1. configure-cloudwatch-logs – 各ノードのライフサイクルアクションログを Amazon CloudWatch Logs に転送します。最初に設定し、その後のアクションでノードの最初のブートから出力がキャプチャされるようにします。

      • ライフサイクルステージ – を選択しますnodeBootstrapped

      • スクリプトの場所 – と入力しs3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/configure-cloudwatch-logs-v1-latest.shregion をクラスターの AWS Region に置き換えます。

      • 名前 – と入力しますconfigure-cloudwatch-logs

      • 引数 – このフィールドは空のままにします。スクリプトは自動的にログを/aws/pcs/cluster-id/lifecycleロググループに送信します。

      • エラー処理の動作 – を選択しますCONTINUE

      • 実行ポリシー – を選択しますFIRST_BOOT_ONLY

    2. configure-efs-homes – Amazon EFS ファイルシステムを のホームディレクトリベースとしてマウント/homeし、初回ログイン時に各ユーザーのホームディレクトリを作成するようにノードを設定します。

      • ライフサイクルステージ – を選択しますnodeBootstrapped

      • スクリプトの場所 – と入力しs3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/configure-efs-homes-v1-latest.shregion をクラスターの AWS Region に置き換えます。

      • 名前 – と入力しますconfigure-efs-homes

      • 引数 – 「」と入力し--efs-id efs-file-system-id --home-base /home --options tlsefs-file-system-id をチュートリアルの前半で作成した EFS ファイルシステムの ID に置き換えます。

      • エラー処理の動作 – を選択しますCONTINUE

      • 実行ポリシー – を選択しますEVERY_BOOT

    3. mount-fsx-lustre – FSx for Lustre ファイルシステムを にマウント/sharedして、高性能の共有スクラッチストレージを実現します。

      • ライフサイクルステージ – を選択しますnodeBootstrapped

      • スクリプトの場所 – と入力しs3://aws-pcs-repo-region/aws-pcs-node-lifecycle-scripts/mount-fsx-lustre-v1-latest.shregion をクラスターの AWS リージョン ( など) に置き換えますus-east-1

      • 名前 – と入力しますmount-fsx-lustre

      • 引数 – を入力します。fsx-dns-nameDNS 名に置き換え、mount-name を FSx for Lustre ファイルシステムの作成時にメモしたマウント名--fsx-dns-name fsx-dns-name --mount-name mount-name --mount-point /sharedに置き換えます。

      • エラー処理の動作 – を選択しますCONTINUE

      • 実行ポリシー – を選択しますEVERY_BOOT

    4. set-shared-dir-mode – ユーザーがファイルを作成できるように、ワールド書き込み可能なスティッキーアクセス許可 (モード 1777) /sharedに設定します。マウントされたファイルシステムに適用されるmount-fsx-lustreように、 の後に実行されます。

      • ライフサイクルステージ – を選択しますnodeBootstrapped

      • スクリプトの場所 – と入力しますhttps://aws-hpc-recipes.s3.us-east-1.amazonaws.com/main/recipes/pcs-scripts/open_shared_dir/assets/set-shared-dir-mode-v1.0.0.sh。このコミュニティスクリプトは、HPC Recipes for によって公開されます AWS。

      • 名前 – と入力しますset-shared-dir-mode

      • 引数 – と入力します--path /shared --mode 1777

      • エラー処理の動作 – を選択しますCONTINUE

      • 実行ポリシー – を選択しますEVERY_BOOT

  • コンピューティングノードグループの作成 を選択します。

Status フィールドには、コンピューティングノードグループのプロビジョニング中に作成中と表示されます。チュートリアルの進行中は、次のステップに進むことができます。