백업 및 disaster recovery(DR) 전략은 다음 질문에 답합니다: 데이터나 region 전체를 잃으면 얼마나 많은 데이터를 잃을 수 있고, 얼마나 빨리 복구할 수 있으며, 실제로 복원할 수 있는가? 이는 3-2-1 규칙, 명확한 RPO/RTO 목표, 그리고 — 결정적으로 — 정기적으로 테스트된 복원에 기반합니다.
데이터 사본 3개
서로 다른 매체 / 저장 유형 2가지
1개 사본은 offsite (다른 region 또는 공급자)
→ 단일 장애(디스크, 호스트, 데이터센터, 랜섬웨어)가 모든 사본을 파괴하지 못함
백업은 자동화(사람이 실행을 기억할 필요 없음)되고 offsite여야, region급 재해가 backup과 primary를 함께 가져가지 않습니다.
이 두 목표가 모든 설계 선택을 좌우합니다:
잦은 백업 / replication → 더 작은 RPO (데이터 손실 감소)
더 "뜨거운" standby 인프라 → 더 작은 RTO (복구 가속)
둘 다 비용이 듦 → 비즈니스 중요도에 따라 목표 선택
Backup & restore → 가장 저렴; 필요 시 백업에서 복원 (RTO: 수 시간)
Pilot light → 최소 핵심만 가동, 재해 시 scale up (RTO: 수십 분)
Warm standby → 축소된 live 사본, scale up하여 인수 (RTO: 수 분)
Multi-site active → 완전한 live 사본이 트래픽을 서비스 (RTO: ~수 초)
한 번도 복원해본 적 없는 백업은 백업이 아니라 희망입니다. 정기적인 복원 훈련을 일정에 넣으세요: 실제로 백업에서 깨끗한 환경으로 재구축하고 무결성을 검증하세요. 이는 손상된 백업, 누락된 조각, 깨진 runbook을 실제 재해 전에 잡아냅니다.
데이터 손실과 region급 장애는 회사의 생존이 시험받는 순간입니다. 3-2-1은 어떤 단일 장애에도 사본 하나가 살아남게 하고, RPO/RTO는 막연한 "백업은 있다"를 측정 가능한 약속으로 바꾸며, DR 계층은 비용을 중요도에 맞추게 하고, 테스트된 복원은 전체가 실제로 동작한다는 유일한 증거입니다. 테스트를 건너뛰는 것이 바로 팀이 장애 한가운데에서 자신의 백업이 쓸모없었음을 발견하는 방식입니다.
주니어부터 시니어까지 상세한 답변이 포함된 IT 면접 질문 라이브러리.
후원하기