기계 번역으로 제공되는 번역입니다. 제공된 번역과 원본 영어의 내용이 상충하는 경우에는 영어 버전이 우선합니다.
AWS PCS에서 컴퓨팅 작업을 실행하기 위한 컴퓨팅 노드 그룹 생성
이 단계에서는 클러스터에 제출된 작업을 실행하도록 탄력적으로 확장되는 컴퓨팅 노드 그룹을 시작합니다.
컴퓨팅 노드 그룹을 생성하려면
-
AWS PCS 콘솔
을 열고 클러스터로 이동합니다. -
라는 클러스터를 선택합니다.
get-started -
컴퓨팅 노드 그룹으로 이동하여 생성을 선택합니다.
-
컴퓨팅 노드 그룹 설정 섹션에서 다음을 제공합니다.
-
컴퓨팅 노드 그룹 이름 -를 입력합니다
compute-1.
-
-
컴퓨팅 구성에서 다음 값을 입력하거나 선택합니다.
-
EC2 시작 템플릿 - 이름이 인 시작 템플릿을 선택합니다.
compute-getstarted-lt -
IAM 인스턴스 프로파일 - 라는 인스턴스 프로파일을 선택합니다.
AWSPCS-getstarted-role -
서브넷 - 이름이 로 시작하는 서브넷을 선택합니다
hpc-networking:PrivateSubnetA. 컴퓨팅 노드는 작업을 처리하고 인터넷에서 연결할 필요가 없으므로 프라이빗 서브넷에서 실행됩니다. -
인스턴스 -를 선택합니다
c6i.xlarge. -
조정 구성 - 최소 인스턴스 수에를 입력합니다
0. 최대 인스턴스 수에 를 입력합니다.4최소0를 사용하면 실행할 작업이 없을 때 AWS PCS가 그룹을 인스턴스 없음으로 축소할 수 있으므로 작업이 대기열에 있을 때만 컴퓨팅 비용을 지불합니다.
-
-
추가 설정에서 다음을 지정합니다.
-
AMI ID - 다음 형식의 이름을 가진 사용하려는 AMI를 선택합니다.
aws-pcs-sample_ami-al2023-platform-slurm-version참고
Slurm 25.05 및 이전 버전의 샘플 AMIs Amazon Linux 2023(
amzn2) 대신 Amazon Linux 2()를 사용합니다al2023.
-
-
노드 수명 주기 작업 섹션에서 공유 스토리지를 탑재하고 노드 로그를 전달하는 스크립트를 추가합니다. 다음 각 작업에 대해 스크립트 추가를 선택합니다. 스크립트는 단계 내에서 위에서 아래로 실행되므로 표시된 순서대로 추가합니다. AWS에서 유지 관리하는 스크립트에 대한 자세한 내용은 섹션을 참조하세요AWS유지 관리형 스크립트.
-
configure-cloudwatch-logs - 각 노드의 수명 주기 작업 로그를 Amazon CloudWatch Logs에 전달합니다. 다음 작업이 노드의 첫 번째 부팅에서 출력을 캡처하도록 먼저 구성합니다.
-
수명 주기 단계 -를 선택합니다
nodeBootstrapped. -
스크립트 위치 -
s3://aws-pcs-repo-를 입력하여region/aws-pcs-node-lifecycle-scripts/configure-cloudwatch-logs-v1-latest.sh리전을 클러스터의 AWS 리전으로 바꿉니다. -
이름 -를 입력합니다
configure-cloudwatch-logs. -
인수 -이 필드는 비워 둡니다. 스크립트는 로그 그룹에
/aws/pcs/로그를 자동으로 전송합니다.cluster-id/lifecycle -
오류 처리 동작 -를 선택합니다
CONTINUE. -
실행 정책 -를 선택합니다
FIRST_BOOT_ONLY.
-
-
configure-efs-homes - Amazon EFS 파일 시스템을의 홈 디렉터리 기본으로 탑재
/home하고 첫 로그인 시 각 사용자의 홈 디렉터리를 생성하도록 노드를 구성합니다.-
수명 주기 단계 -를 선택합니다
nodeBootstrapped. -
스크립트 위치 -
s3://aws-pcs-repo-를 입력하여region/aws-pcs-node-lifecycle-scripts/configure-efs-homes-v1-latest.sh리전을 클러스터의 AWS 리전으로 바꿉니다. -
이름 -를 입력합니다
configure-efs-homes. -
인수 -를 입력하여
efs-file-system-id를 자습서의 앞부분에서 생성한 EFS 파일 시스템의 ID로--efs-id바꿉니다.efs-file-system-id--home-base /home --options tls -
오류 처리 동작 -를 선택합니다
CONTINUE. -
실행 정책 -를 선택합니다
EVERY_BOOT.
-
-
mount-fsx-lustre - 고성능 공유 스크래치 스토리지를
/shared위해에 FSx for Lustre 파일 시스템을 탑재합니다.-
수명 주기 단계 -를 선택합니다
nodeBootstrapped. -
스크립트 위치 -
s3://aws-pcs-repo-를 입력하여region/aws-pcs-node-lifecycle-scripts/mount-fsx-lustre-v1-latest.sh리전을 클러스터의 AWS 리전으로 바꿉니다(예:us-east-1). -
이름 -를 입력합니다
mount-fsx-lustre. -
인수 -를 입력하여
fsx-dns-name을 DNS 이름으로--fsx-dns-name바꾸고fsx-dns-name--mount-namemount-name--mount-point /sharedmount-name을 FSx for Lustre 파일 시스템을 생성할 때 기록해 둔 탑재 이름으로 바꿉니다. -
오류 처리 동작 -를 선택합니다
CONTINUE. -
실행 정책 -를 선택합니다
EVERY_BOOT.
-
-
set-shared-dir-mode - 모든 사용자가 파일을 생성할 수 있도록
/shared월드 라이팅 가능한 고정 권한(모드1777)으로 설정합니다. 탑재된 파일 시스템에 적용mount-fsx-lustre되도록 이후에 실행됩니다.-
수명 주기 단계 -를 선택합니다
nodeBootstrapped. -
스크립트 위치 -를 입력합니다
https://aws-hpc-recipes.s3.us-east-1.amazonaws.com/main/recipes/pcs-scripts/open_shared_dir/assets/set-shared-dir-mode-v1.0.0.sh. 이 커뮤니티 스크립트는 HPC 레시피에서 게시합니다 AWS. -
이름 -를 입력합니다
set-shared-dir-mode. -
인수 -를 입력합니다
--path /shared --mode 1777. -
오류 처리 동작 -를 선택합니다
CONTINUE. -
실행 정책 -를 선택합니다
EVERY_BOOT.
-
-
-
컴퓨팅 노드 그룹 생성을 선택합니다.
상태 필드에는 컴퓨팅 노드 그룹이 프로비저닝되는 동안 생성이 표시됩니다.
중요
이 자습서의 다음 단계로 진행하기 전에 상태 필드에 활성이 표시될 때까지 기다립니다.