View a markdown version of this page

에 대한 서비스 할당량 및 제한 Deadline Cloud - AWS 기한 클라우드

기계 번역으로 제공되는 번역입니다. 제공된 번역과 원본 영어의 내용이 상충하는 경우에는 영어 버전이 우선합니다.

에 대한 서비스 할당량 및 제한 Deadline Cloud

AWS Deadline Cloud 는 작업을 처리하는 데 사용할 수 있는 팜, 플릿 및 대기열과 같은 리소스를 제공합니다. 를 생성하면 각 리소스에 대해 이러한 리소스에 기본 할당량이 AWS 계정설정됩니다 AWS 리전. Deadline Cloud 또한 API 요청 속도도 제한됩니다. 자세한 내용은 API 요청 제한 단원을 참조하십시오.

Service Quotas는에 대한 할당량을 보고 관리할 수 있는 중앙 위치입니다 AWS 서비스. 사용하는 많은 리소스에 대한 할당량 증가를 요청할 수도 있습니다.

할당량을 보려면 Service Quotas 콘솔을 Deadline Cloud엽니다. 탐색 창에서 AWS 서비스을(를) 선택한 다음 Deadline Cloud을(를) 선택합니다.

할당량 증가를 요청하려면 Service Quotas 사용 설명서할당량 증가 요청을 참조하세요. Service Quotas에서 아직 할당량을 사용할 수 없는 경우 서비스 할당량 증가 양식을 사용합니다.

AWS 계정에는 다음과 관련된 할당량이 있습니다 Deadline Cloud.

연결된 멤버 할당량은 팜, 플릿, 대기열 또는 작업에 할당한 멤버십 수를 계산합니다. 각 사용자 권한 부여 및 각 그룹 권한 부여는 하나의 멤버십으로 계산되므로 포함된 사용자 수에 관계없이 그룹은 하나의 멤버로 계산됩니다.는 그룹의 사용자 수 또는 사용자가 속한 그룹 수를 제한하지 Deadline Cloud 않습니다. 대신에 대한 할당량이 AWS IAM Identity Center 적용됩니다. 멤버십 할당량 내에서 더 많은 사용자에게 액세스 권한을 부여하려면 개별 사용자 대신 그룹을 할당합니다. 자세한 내용은 Deadline Cloud에서 권한이 작동하는 방식 단원을 참조하십시오.

서비스 관리형 플릿에 대한 컴퓨팅은 Amazon Elastic Compute Cloud(Amazon EC2) 서비스 할당량이 아닌 다음 표의 Deadline Cloud vCPU 및 GPU 할당량에 대해 계산됩니다. 자세한 내용은 관련 서비스에 대한 할당량 단원을 참조하십시오.

다음 표에는 서비스 관리형 플릿에서 사용하는 영구 스토리지 볼륨에 대한 할당량이 포함되어 있습니다. 영구 스토리지에 대한 자세한 내용은 섹션을 참조하세요서비스 관리형 플릿을 위한 영구 스토리지.

이름 기본값 조정 가능 설명
팜당 연결된 멤버 지원되는 각 리전: 75 아니요 현재 AWS 리전의 각 팜에 연결할 수 있는 최대 보안 주체(사용자 또는 그룹) 수입니다. 연결된 각 그룹은 포함된 사용자 수에 관계없이 하나의 멤버로 계산됩니다.
플릿당 연결된 멤버 지원되는 각 리전: 75 아니요 현재 AWS 리전의 각 플릿에 연결할 수 있는 최대 보안 주체(사용자 또는 그룹) 수입니다. 연결된 각 그룹은 포함된 사용자 수에 관계없이 하나의 멤버로 계산됩니다.
작업당 연결된 멤버 지원되는 각 리전: 75 아니요 현재 AWS 리전의 각 작업에 연결할 수 있는 최대 보안 주체(사용자 또는 그룹) 수입니다. 연결된 각 그룹은 포함된 사용자 수에 관계없이 하나의 멤버로 계산됩니다.
대기열당 연결된 멤버 지원되는 각 리전: 75 아니요 현재 AWS 리전의 각 대기열에 연결할 수 있는 최대 보안 주체(사용자 또는 그룹) 수입니다. 연결된 각 그룹은 포함된 사용자 수에 관계없이 하나의 멤버로 계산됩니다.
팜당 예산 지원되는 각 리전: 20개 현재 AWS 리전의 팜당 최대 예산 수
리전당 팜 지원되는 각 지역: 2 현재 AWS 리전에서 생성할 수 있는 최대 팜 수입니다.
팜당 플릿 지원되는 각 리전: 5개 현재 AWS 리전의 각 팜에 대해 생성할 수 있는 최대 플릿 수입니다.
팜당 작업 지원되는 각 리전: 100,000 현재 AWS 리전의 팜당 최대 작업 수입니다.
리전당 라이선스 엔드포인트 지원되는 각 리전: 5개 현재 AWS 리전의 최대 라이선스 엔드포인트 수입니다.
라이선스 엔드포인트당 라이선스 세션 지원되는 각 리전: 500 현재 AWS 리전의 라이선스 엔드포인트당 최대 라이선스 세션 수입니다.
팜당 제한 지원되는 각 지역: 50 현재 AWS 리전의 각 팜에 대해 생성할 수 있는 최대 한도 수입니다.
리전당 모니터 지원되는 각 리전: 1 아니요 현재 AWS 리전의 최대 모니터 수입니다.
리전당 온디맨드 G 인스턴스 GPU 지원되는 각 리전: 0 현재 AWS 리전의 모든 서비스 관리형 플릿에 프로비저닝할 수 있는 온디맨드 G 인스턴스 GPUs의 최대 수입니다.
리전당 온디맨드 vCPU 지원되는 각 지역: 50 현재 AWS 리전의 모든 서비스 관리형 플릿에 프로비저닝할 수 있는 온디맨드 vCPUs의 최대 수입니다.
대기열당 대기열 환경 지원되는 각 리전: 10 아니요 현재 AWS 리전의 각 대기열에 대해 생성할 수 있는 최대 대기열 환경 수입니다.
팜당 대기열 플릿 연결 지원되는 각 리전: 100 현재 AWS 리전의 팜당 최대 대기열 플릿 연결 수
대기열당 대기열 제한 연결 지원되는 각 리전: 10개 현재 AWS 리전의 각 대기열과 연결할 수 있는 최대 제한 수입니다.
팜당 대기열 지원되는 각 리전: 20개 현재 AWS 리전의 각 팜에 대해 생성할 수 있는 최대 대기열 수입니다.
플릿당 리소스 구성 각 지원되는 지역: 1 각 플릿에 추가할 수 있는 VPC Lattice 리소스 구성의 최대 수입니다.
리전당 스팟 G 인스턴스 GPU 지원되는 각 리전: 0 현재 AWS 리전의 모든 서비스 관리형 플릿에 프로비저닝할 수 있는 스팟 G 인스턴스 GPUs의 최대 수입니다.
리전당 스팟 vCPU 지원되는 각 지역: 50 현재 AWS 리전의 모든 서비스 관리형 플릿에 프로비저닝할 수 있는 스팟 vCPUs의 최대 수입니다.
단계당 단계 소비자 지원되는 각 리전: 32 현재 AWS 리전의 작업 내에서 단일 단계에 대한 종속성을 선언(소비)할 수 있는 최대 단계 수입니다.
단계당 단계 종속성 지원되는 각 리전: 128개 작업 내 단일 단계가 현재 AWS 리전에서 종속성을 선언할 수 있는 최대 단계 수입니다.
작업당 단계 지원되는 각 리전: 200 현재 AWS 리전의 작업당 최대 단계 수입니다.
범용 SSD(gp3) 볼륨을 위한 스토리지(TiB) 각 지원되는 지역: 1 현재 AWS 리전의 모든 플릿에서 사용할 수 있는 TiB로 측정된 EBS 스토리지의 최대 집계량입니다.
TiB의 영구 범용 SSD(gp3) 볼륨을 위한 스토리지 지원되는 각 리전: 4 현재 AWS 리전의 영구 범용 SSD(gp3) 볼륨에 프로비저닝할 수 있는 TiB 단위의 최대 집계 스토리지 양입니다.
팜당 스토리지 프로필 지원되는 각 리전: 50 아니요 현재 AWS 리전의 각 팜에 대해 생성할 수 있는 스토리지 프로파일의 최대 수입니다.
청크당 작업 수 지원되는 각 리전: 150개 아니요 작업을 제출할 때 단일 청크로 결합할 수 있는 최대 작업 수입니다.
작업당 작업 지원되는 각 리전: 10,000 현재 AWS 리전의 작업당 최대 작업 수입니다.
단계당 작업 지원되는 각 리전: 10,000 현재 AWS 리전의 단계당 최대 작업 수입니다.
리전당 wait-and-save vCPU 지원되는 각 지역: 50 현재 AWS 리전의 모든 서비스 관리형 플릿에 프로비저닝할 수 있는 최대 wait-and-save vCPUs 수입니다.
팜당 작업자 지원되는 각 리전: 7,500 현재 AWS 리전의 팜당 최대 작업자 수입니다.

API 요청 제한

Deadline Cloud 는 각의 각 AWS 계정 에 대한 API 요청 속도를 제한합니다 AWS 리전. 기본 요청 속도는 대규모 워크로드 및 사용량을 지원합니다. 요청이 허용된 속도를 초과하면는 HTTP 429 상태 코드와 ThrottlingException 오류가 있는 요청을 Deadline Cloud 거부합니다.

지수 백오프를 사용하여 AWS SDKs 및가 제한된 요청을 AWS CLI 자동으로 재시도합니다. 애플리케이션을 변경할 필요 없이 가끔 스로틀링이 해결됩니다. 지속적인 제한이 발생하는 경우 AWS Support에 문의하여 더 높은 요청 속도를 요청하세요.

일부 Deadline Cloud 기능은 다른 기능을 사용 AWS 서비스하며 해당 서비스에 대한 할당량도 적용됩니다.

고객 관리형 플릿에 대한 Amazon EC2 할당량

Amazon Elastic Compute Cloud(Amazon EC2) 할당량은 고객 관리형 플릿에 적용됩니다. 해당 작업자가 자체 계정의 인스턴스에서 실행되기 때문입니다. 서비스 관리형 플릿에 대한 컴퓨팅은 대신 이전 표의 Deadline Cloud vCPU 및 GPU 할당량에 대해 계산됩니다.

Amazon EC2 할당량을 보거나 늘리려면 Service Quotas 콘솔을 열고 Amazon Elastic Compute Cloud를 선택합니다. 자세한 내용은 Amazon EC2 사용 설명서Amazon EC2 서비스 할당량을 참조하세요.

Deadline Cloud 어시스턴트에 대한 Amazon Bedrock 할당량

는에서 Amazon Bedrock 온디맨드 추론을 Deadline Cloud 어시스턴트 사용 AWS 계정하므로 계정의 Amazon Bedrock 서비스 할당량이 적용됩니다. 두 가지 기본 제약 조건은 다음과 같습니다.

  • 분당 요청 수(RPM) - 분당 허용되는 모델 호출 요청 수입니다.

  • 분당 토큰 수(TPM) - 분당 처리된 총 입력 및 출력 토큰 수입니다.

기본 할당량은 리전에 따라 다릅니다. 일부 리전에는 20RPM만큼 낮은 기본 제한이 있으므로 어시스턴트 사용량이 많을 때 제한이 발생할 수 있습니다. 어시스턴트는 최소 200RPM을 지원하는 교차 리전 추론 프로파일을 사용합니다. 교차 리전 추론은 단일 리전 제한이 더 낮은 리전에서 제한을 완화하는 데 도움이 될 수 있습니다. 리전에서 교차 리전 추론을 사용하는 경우 대상 리전의 서비스 할당량도 적용됩니다.

어시스턴트를 사용할 때 제한 오류가 발생하는 경우 Amazon Bedrock 서비스 할당량 증가를 요청할 수 있습니다.

할당량 증가 요청
  1. Service Quotas Console을 엽니다.

  2. 탐색 창에서 AWS 서비스를 선택한 다음 Amazon Bedrock을 선택합니다.

  3. 어시스턴트가 사용하는 모델의 할당량을 찾습니다(InvokeModelWithResponseStream관련 모델의와 관련된 할당량 찾기).

  4. 할당량 이름을 선택한 다음 계정 수준에서 증가 요청을 선택합니다.

  5. 원하는 할당량 값을 입력하고 요청을 제출합니다.

CloudWatch 지표를 통해 Amazon Bedrock 할당량 사용량을 모니터링할 수 있습니다. Amazon Bedrock 조절 지표에 대한 CloudWatch 경보를 설정하여 할당량 한도에 도달하는 시점을 식별합니다. 자세한 내용은 Amazon Bedrock 사용 설명서의 Amazon Bedrock 모니터링을 참조하세요.