Amazon DynamoDB 워크로드에 대한 재해 복구 전략 선택
DynamoDB DR 전략을 선택하기 전에 비즈니스 복구 요구 사항을 정의해야 합니다. 이 초기 분석은 비용이 많이 드는 과다 엔지니어링을 방지하는 동시에 중요한 비즈니스 연속성 요구 사항을 충족하는 데 도움이 됩니다. 최적의 접근 방식은 복구 속도, 데이터 손실 허용 범위, 구현 복잡성, 운영 비용이라는 네 가지 주요 요소의 균형을 맞춥니다.
DR 전략을 구성하는 두 가지 주요 지표를 살펴보겠습니다.
-
목표 복구 시간(RTO) - 서비스 중단과 서비스 복원 사이의 허용 가능한 최대 지연 시간입니다. RTO는 "얼마나 오래 가동 중지를 감수할 수 있습니까?"라는 질문에 답합니다. 비즈니스 요구 사항에 따라 0(지속적 가용성 필요)에서 몇 시간까지 다양할 수 있습니다.
-
목표 복구 시점(RPO) - 마지막 데이터 복구 시점 이후 허용되는 최대 시간입니다. RPO는 "얼마나 많은 데이터 손실을 감수할 수 있습니까?"라는 질문에 답합니다. 예를 들어 RPO가 1시간인 경우 DR 솔루션은 인시던트가 시작되기 전 1시간 이내의 지점으로 데이터를 복구할 수 있어야 합니다.
DynamoDB DR 전략은 다음 요소를 기반으로 선택해야 합니다.
서비스 중단의 비즈니스 영향 분석
다양한 재해 시나리오의 위험 평가
각 DR 옵션 구현 비용
데이터 보호 및 가용성에 대한 규제 요구 사항
DynamoDB DR 접근 방식을 선택하기 위한 결정 지점
적절한 DynamoDB DR 접근 방식을 선택할 때는 특정 비즈니스 요구 사항, 위험 허용 범위, 규제 요구 사항 및 예산 제약 조건을 평가해야 합니다.
가동 중단 중 매출 손실이 추가 운영 비용을 크게 초과하는 가동 중지 시간 없음 요구 사항의 경우, 다중 리전 강력한 일관성(MRSC) 테이블을 포함한 글로벌 테이블 아키텍처가 즉각적인 복구 기능을 제공합니다. 이러한 솔루션은 운영 비용이 더 높지만 즉각적인 장애 조치와 지속적 가용성을 제공하므로 가동 중지 시간이 수익 스트림에 직접적인 영향을 미치는 미션 크리티컬 애플리케이션에 필수적입니다.
유연한 복구 요구 사항이 있는 예산에 민감한 조직은 애플리케이션이 복구 시나리오 중에 몇 시간의 가동 중지 시간을 허용할 수 있는 경우 보다 비용 효율적인 솔루션을 사용할 수 있습니다. 온디맨드 백업, AWS Backup 또는 Amazon Simple Storage Service 내보내기 전략은 더 긴 복구 기간을 허용하면서 운영 비용을 크게 절감합니다. 이러한 접근 방식은 비즈니스 연속성은 중요하지만 즉각적인 복구가 재정적으로 정당화되지 않는 애플리케이션에 적합하여 보호와 비용 최적화의 균형을 맞출 수 있는 옵션을 제공합니다.
규정 준수 요구 사항에는 감사 준비 및 적절한 데이터 보존 정책을 보장하는 자동화된 솔루션이 필요합니다. 교차 리전 복제를 사용한 AWS Backup은 포괄적인 규정 준수 자동화를 제공하지만 더 높은 비용 구조를 유지합니다. 이 접근 방식은 규제 프레임워크에 필요한 문서화, 보존 정책, 지리적 분산을 제공하는 동시에 수동 규정 준수 오버헤드를 줄이고 조직 전체에서 일관된 백업 절차를 확보하는 데 도움이 됩니다.
실수로 인한 삭제 또는 데이터 손상과 같은 인적 오류 시나리오에 대한 보호 기능으로, 삭제 방지와 결합된 시점 복구(PITR)는 단일 리전 내에서 지속적인 보호를 제공합니다. 이 솔루션은 운영상 실수로부터 뛰어난 보호를 제공하고 합리적인 비용을 유지하지만, 단일 리전 제한을 감수하고 리전 중단 또는 인프라 장애와 관련된 진정한 DR 시나리오에 대한 추가 전략을 계획해야 합니다.
재해 복구 옵션
DynamoDB는 테이블 데이터를 백업 및 복원하는 옵션을 제공하여 다양한 장애 시나리오에 대한 복원력을 제공합니다. 다양한 요구 사항을 충족하는 네 가지 주요 DR 솔루션이 있습니다.
지속적인 데이터 보호를 위한 시점 복구(PITR)
유연한 보호를 위한 온디맨드 백업 및 복원
자동 정기 보호를 위한 예약된 백업 및 복원
미션 크리티컬 워크로드의 즉각적인 복구를 위한 글로벌 테이블
| 백업 유형 | 백업 옵션 | 기능 | RPO | RTO | 백업 가용성 | 월별 백업 비용 | 일회성 복원 비용 |
|---|---|---|---|---|---|---|---|
|
지속적인 데이터 보호 |
PITR |
최대 35일 동안 유지되는 연속 백업으로, 구성된 백업 기간 내의 어느 시점에서든 몇 초 이내에 PITR을 활성화할 수 있습니다. |
초 |
분 |
단일 AWS 리전만 |
GB/월당 0.20 USD |
GB당 0.15 USD |
|
온디맨드 보호 |
온디맨드 백업 및 복원 |
온디맨드 프로세스 |
시간 |
분 |
단일 AWS 리전 |
GB/월당 0.10 USD |
GB당 0.15 USD |
|
예약된 백업 및 복원 |
AWS Backup |
유연한 예약 옵션(시간 단위부터 월 단위까지) |
시간 |
분 |
교차 리전 백업 지원 |
GB/월당 0.10 USD |
GB당 0.15 USD |
|
Amazon S3 내보내기 및 가져오기(PITR이 활성화됨) |
PITR 기간 내의 전체 또는 증분 데이터를 버킷으로 내보내기 |
분 |
시간 |
버킷으로 교차 리전 백업 가능 |
GB당 0.10 USD |
GB당 0.15 USD |
|
|
미션 크리티컬 워크로드를 위한 즉각적인 복구 |
전역 테이블 |
완전관리형 솔루션, 다중 리전, 다중 활성 테이블 |
초 |
Zero |
기본 리전에서 보조 리전으로 데이터 변경 사항을 몇 밀리초 이내에 자동 전파 |
복제된 쓰기 요청 단위 100만 개당 0.625 USD |
0 |
|
MRSC 테이블 |
강력한 일관성을 갖춘 완전관리형 솔루션, 다중 리전, 다중 활성 테이블 |
Zero |
Zero |
기본 리전에서 보조 리전으로 데이터 변경 사항을 실시간으로 자동 전파 |
복제된 쓰기 요청 단위 100만 개당 0.625 USD |
0 |
참고
위 표에 표시된 비용은 온디맨드 용량에 대한 DynamoDB 요금
PITR을 사용한 지속적인 데이터 보호
DynamoDB를 재고 관리, 제품 카탈로그 및 주문 처리에 사용하는 전자 상거래 소매업체가 있다고 가정해 보겠습니다. 블랙 프라이데이 이벤트를 준비하는 동안 개발 팀이 실수로 제품 카탈로그를 삭제합니다. PITR을 사용하면 수천 개의 레코드를 30분 내에 정확히 인시던트 전 시점으로 복원하여 수백만 달러의 잠재적 매출 손실을 방지할 수 있습니다.
PITR을 활성화하면 DynamoDB가 초 단위로 테이블 데이터를 자동 백업합니다. 1~35일 범위로 구성된 복구 기간 내의 특정 시점(초 단위)으로 테이블을 복원할 수 있으며, 의 습니다. 특히 보존 기간을 줄여도 비용이 줄어들지 않고 보존 기간을 늘리더라도 추가 비용 부담은 없습니다. PITR 기능은 최소 RPO(초 단위) 및 합리적인 RTO(분~시간 단위)로 세분화된 복구 기능을 제공하므로 다양한 DR 요구 사항에 적합합니다. 실제 시나리오를 통해 인적 오류 또는 애플리케이션 장애로부터 보호하든 엄격한 규제 요구 사항을 충족하든 어떻게 PITR의 최소 RPO 및 합리적인 RTO가 잠재적 비즈니스 재해를 관리 가능한 복구 작업으로 전환하는지 확인할 수 있습니다.
자세한 내용은 DynamoDB에서 시점 복구 활성화를 참조하세요. 이 문서에서는 CloudFormation, AWS CLI 및 DynamoDB API를 사용하여 PITR을 구성하고 테이블을 복원하는 방법에 대한 자세한 지침을 제공합니다.
온디맨드 백업 및 복원을 사용한 유연한 보호
주요 전자 건강 기록(EHR) 시스템 마이그레이션을 계획하는 의료 서비스 제공업체를 생각해 보세요. 마이그레이션 프로세스 전반에 걸쳐 마일스톤 백업을 사용하면 엄격한 HIPAA 요구 사항을 충족하는 동시에 법률 팀에 변경할 수 없는 감사 증거를 제공할 수 있습니다. 마이그레이션 중에 규정 준수 문제가 발생하면 데이터 처리 절차를 정확하게 제시하고 규정을 준수하는 체크포인트로 복원하여 환자 데이터 보호 및 규제 준수를 확보할 수 있습니다.
DynamoDB 온디맨드 백업 기능을 사용하면 필요에 따라 백업을 생성하고 테이블을 복원할 수 있습니다. 온디맨드 백업은 비동기식으로 작동하여 백업 요청 시점까지 모든 변경 사항을 캡처합니다. 온디맨드 백업 기능을 사용하면 다양한 운영 및 규정 준수 요구 사항을 지원하면서 데이터 보호 전략을 정밀하게 제어할 수 있습니다.
온디맨드 백업 및 복원은 동일 리전 시나리오와 교차 리전 시나리오 모두에서 유연한 테이블 복원 기능을 제공하여 다양한 복구 옵션을 활용할 수 있습니다. 비즈니스 연속성을 강화하기 위해 DynamoDB는 테이블 크기에 관계없이 즉각적인 백업 완료를 지원하는 반면, 동일 리전 복원은 복구 시간을 최소화하고 운영 가용성을 극대화하는 최적의 성능을 제공합니다.
일일 백업 전략을 구현하면 신뢰할 수 있는 24시간의 RPO와 몇 분에서 몇 시간의 예측 가능한 RTO를 달성할 수 있습니다. 이러한 구조화된 데이터 보호 접근 방식을 사용하면 비즈니스 운영을 유지하면서 백업 및 복구 전략을 효과적으로 계획하고 실행할 수 있습니다.
DynamoDB 백업 및 복원 작업에 대한 자세한 내용은 DynamoDB 테이블 백업 및 백업에서 DynamoDB 테이블 복원을 참조하세요.
예약된 백업 및 복원을 사용한 자동 정기 보호
DynamoDB는 운영 복구를 위한 사용자 지정 가능한 백업 계획을 사용하는 AWS Backup과 장기 보관, 교차 리전 데이터 마이그레이션 및 지속적 운영을 위한 Amazon S3 내보내기 기능을 포함하여 예약된 워크플로를 통해 자동화할 수 있는 여러 보호 메커니즘을 제공합니다. 이러한 자동화된 정기 보호 일정을 구현하면 복구 목표와 스토리지 비용의 균형을 유지하면서 수동 개입 없이 일관된 데이터 보호를 확보할 수 있습니다.
AWS Backup 및 백업 계획을 사용한 백업 및 복원
Amazon DynamoDB 기반 사기 행위 탐지 시스템에 엔터프라이즈급 보호를 추가해야 하는 다국적 은행을 생각해 보세요. 이 은행은 15개 국가에 걸쳐 비즈니스를 운영하므로 보호 기능은 지속적 가용성을 보장하면서 여러 관할 구역의 다양한 규제 요구 사항에 적응할 수 있어야 합니다.
은행은 AWS Backup의 다중 리전 복제 및 교차 계정 기능을 사용하여 여러 사업부에 대한 엄격한 액세스 제어를 유지하면서 리전 간에 중요한 트랜잭션 데이터를 자동으로 복제하는 보호 아키텍처를 구현했습니다. 세 개 국가의 규제 기관이 규정 준수 감사를 위해 과거 트랜잭션 데이터를 동시에 요청했을 때, 은행의 표준화된 백업 정책 및 세부 감사 추적을 통해 몇 주가 아닌 몇 시간 내에 완전한 문서를 제공할 수 있었습니다.
AWS Backup을 사용하면 특정 AWS 계정 내에서 데이터를 정기적으로 백업할 수 있습니다. 백업 계획을 사용하면 이러한 백업을 온디맨드로 또는 예약된 백업 계획에 따라 자동으로 다른 리전으로 복사할 수 있습니다. 백업 계획은 유연한 예약 옵션을 제공하므로 매시간, 매 12시간, 매일, 매주 또는 매월 등 필요에 맞는 빈도를 선택할 수 있습니다. DynamoDB 백업은 선택한 빈도에 따라 리전 간에 복사됩니다.
AWS Backup 저장소 잠금은 Write Once Read Many(WORM) 백업을 적용하여 백업 저장소의 백업(복구 지점)을 우발적이거나 악의적인 작업으로부터 보호하고 랜섬웨어 공격으로부터 보호합니다. 테이블 크기에 따라 1시간의 RPO와 몇 분에서 몇 시간의 RTO를 달성할 수 있습니다.
AWS Backup이 DynamoDB와 통합되는 방법을 이해하고 백업 기능 및 모범 사례에 대해 알아보려면 DynamoDB와 함께 AWS Backup 사용을 참조하세요.
Amazon Simple Storage Service(Amazon S3) 내보내기 및 가져오기
한 글로벌 금융 서비스 회사가 99.99% 가용성을 유지하면서 여러 관할 구역의 트랜잭션 데이터에 대한 규제 요구 사항을 충족해야 한다고 가정해 보겠습니다. 이 회사는 Amazon S3의 내보내기 및 가져오기 기능을 중심으로 엔터프라이즈 데이터 전략을 구축하여 12개 국가의 데이터 주권법을 준수하기 위해 교차 리전 데이터 복제를 구현하고 리전 장애 조치 메커니즘을 확립할 수 있었습니다. 유럽에서 가동 중단이 발생하는 경우 이러한 시스템은 장애 조치 절차를 자동으로 실행하여 거래 중단 없이 지속적인 운영을 보장하는 데 도움이 됩니다.
이 회사는 Amazon S3로 내보내기/가져오기 기능을 사용하여 모든 12개 리전의 관할 구역별 Amazon S3 버킷으로 일일 전체 백업 및 시간별 증분 내보내기를 생성하여 로컬 데이터 레지던시 요구 사항을 준수하도록 했습니다. 각 리전 테이블은 트랜잭션 데이터를 동일한 관할 구역 내의 암호화된 버킷으로 자동으로 내보냈고, 교차 리전 복제는 중요한 데이터세트에 대한 추가 중복성을 제공했습니다. 내보내기는 읽기 용량 단위(RCU)를 사용하지 않으므로 테이블 성능 또는 가용성에 영향을 주지 않습니다. 회사가 운영되는 리전 중 하나에 장애가 발생하는 경우, 자동 복구 절차를 통해 가장 최근 내보내기를 대체 리전으로 복원하여 전체 거래 작업을 재개할 수 있습니다. 이 내보내기/가져오기 전략은 변경 불가능한 감사 추적을 통한 규정 준수와 강력한 DR 기능을 모두 제공하므로 회사는 모든 가용 리전의 새 테이블로 복원할 수 있는 완전한 트랜잭션 기록을 유지하면서 지속적인 운영을 유지할 수 있으며, 리전 인프라 장애 시 데이터 손실 및 가동 중지 시간을 최소화할 수 있습니다.
DynamoDB를 Amazon S3로 내보내면 PITR 기간 내의 특정 시점에서 DynamoDB 테이블의 데이터를 내보낼 수 있습니다. 테이블 크기에 따라 몇 분의 RPO와 몇 분에서 몇 시간의 RTO를 달성할 수 있습니다.
내보내기 구성에 대한 자세한 구현 지침은 DynamoDB에서 테이블 내보내기 요청을 참조하세요. 복원 작업 및 데이터 가져오기는 DynamoDB에서 테이블 가져오기 요청을 참조하세요.
글로벌 테이블을 사용한 미션 크리티컬 워크로드의 즉각적인 복구
DynamoDB 글로벌 테이블은 기본 리전 중단 시 강력한 장애 조치 기능을 제공하므로 애플리케이션은 트래픽을 정상 리전으로 즉시 리디렉션하고 운영을 계속할 수 있습니다. 글로벌 테이블에는 다중 리전 궁극의 일관성(MREC) 및 다중 리전 강력한 일관성(MRSC)이라는 두 가지 옵션이 있습니다.
다중 리전 궁극의 일관성
북미, 유럽 및 아시아 태평양 전역의 수백만 고객에게 서비스를 제공하고 있지만 적절한 글로벌 인프라가 없어 심각한 운영 문제에 직면할 수 있는 다국적 전자 상거래 서비스가 있다고 가정해 보겠습니다. 해외 고객의 느린 체크아웃 속도, 여러 관할 구역에 걸친 복잡한 규정 준수 요구 사항, 리전 중단 시 자주 발생하는 가동 중단을 겪을 수 있습니다. 이 회사는 DynamoDB 글로벌 테이블을 구현하여 운영을 혁신할 수 있었습니다. 즉, 지연 시간이 매우 짧은 로컬 데이터 액세스를 통해 도쿄의 고객도 뉴욕의 고객과 마찬가지로 초고속 체크아웃을 경험할 수 있게 된 것입니다. 악천후로 인해 기본 리전이 중단되는 경우, 고객이 인지하지 못하는 사이에 애플리케이션이 다른 리전으로 원활하게 장애 조치할 수 있습니다. 이를 통해 고가용성을 유지하고, 글로벌 읽기 및 쓰기 지연 시간을 개선하고, 운영 중인 리전에서 규정 준수를 지원하고, 현지 요구 사항을 충족하면서 인프라를 전 세계적으로 안정적으로 확장할 수 있다는 확신을 바탕으로 신규 시장으로 확장할 수 있습니다.
DynamoDB 글로벌 테이블은 대규모 글로벌 애플리케이션에 빠른 로컬 읽기 및 쓰기 성능을 제공하도록 설계된 완전관리형 다중 리전 다중 활성 데이터베이스 솔루션입니다. DR 목적으로 테이블을 사용할 기본 리전 및 DR 리전을 지정할 수 있습니다. DynamoDB는 진행 중인 데이터 변경 사항을 기본 리전에서 DR 복제본으로 자동으로 전파합니다. MREC 설정을 사용하면 몇 초의 RPO와 0의 RTO를 달성할 수 있습니다.
DynamoDB 글로벌 테이블 생성 및 관리에 대한 지침은 글로벌 테이블 - DynamoDB용 다중 리전 복제를 참조하세요.
다중 리전 강력한 일관성
세 개 대륙에서 매일 수백만 건의 트랜잭션을 처리하는 선도적인 디지털 뱅킹 플랫폼이 피크 거래 시간에 상당한 리전 중단을 경험할 수 있다고 가정해 보겠습니다. 수동 DR 절차로 허둥대며 수백만 건의 잠재적 손실에 직면하는 대신, 아키텍처는 몇 초 내에 DR을 활성화하여 고객이 중단을 인지하지 못하는 사이에 트래픽을 정상 리전으로 원활하게 리디렉션합니다. 이 은행의 모바일 앱은 대출 신청을 실시간으로 계속 처리할 수 있고, 거래 플랫폼은 고빈도 거래에 대해 밀리초의 응답 시간을 유지하며, 고객 계좌 잔액은 모든 리전에서 완벽하게 동기화됩니다.
다중 리전 강력히 일관된 글로벌 테이블을 사용하여 제로 RPO의 애플리케이션을 구축할 수 있습니다. 제로 RPO는 애플리케이션 중단으로 인해 트래픽을 다른 리전으로 전환하더라도 애플리케이션이 항상 최신 버전의 DynamoDB 데이터를 읽을 수 있다는 의미입니다.
참고
DR 목적으로 두 개의 복제본과 한 개의 감시 리전을 사용할 수 있습니다.
MRSC 글로벌 테이블 생성에 대한 자세한 내용은 글로벌 테이블 작동 방식을 참조하세요.