Сочетайте периодические снапшоты с непрерывным архивированием WAL для point-in-time recovery, реплицируйте offsite/cross-region и подтверждайте это регулярными учениями по восстановлению против явных целей RPO/RTO. Бэкап, который вы никогда не восстанавливали, — это надежда, а не план.
Архитектура
Primary DB ──snapshot (daily)──▶ Object store (S3) ──cross-region replicate──▶ DR region
│ ▲
└── WAL/binlog stream ──────────┘ (continuous, PITR to any second)
│
restore drill ──┴──▶ verified restore ─▶ measure RTO, checksum RPO
