← Cloud Service
Cloud Engineering Know-how

Reliability, Backup & Disaster Recovery Design

ApplicationやDataを継続的に提供するためには、単一障害でSystem全体が停止しない構成と、障害・災害発生時に目標時間内で復旧できる仕組みの両方が必要です。

Systemの重要度、Recovery Objective、Cost、運用条件を踏まえ、High AvailabilityからBackup、Disaster Recoveryまでを一体として設計します。

Design Scope

What We Design

01

Reliability & Resilience Design

  • High Availability & Failover Design
  • Failure Boundary & SPOF Review

Application、Database、Networkなどの構成要素について、Multi-AZ、複数Instance、Load Balancer、Database Failoverなどを利用し、一部Componentに障害が発生してもServiceを継続できる構成を設計します。

また、System全体の依存関係を確認し、Single Point of Failureとなる箇所や、一つの障害が他のComponentへ波及する可能性を整理します。障害の影響範囲を限定できるFailure Boundaryを考慮してArchitectureを設計します。

02

Backup & Disaster Recovery Design

  • Recovery Objective & DR Strategy
  • Backup & Retention Design
  • DR Architecture & Recovery Testing

Systemの重要度、許容停止時間、許容可能なData Loss、Cost、既存Architectureや運用上の制約を整理し、Business / System OwnerとRTO / RPOを定義します。

そのRecovery Objectiveと各種制約に応じて、Backup & Restore、Pilot Light、Warm Standby、Active-Activeなど、異なるCostとRecovery Levelを持つDR方式を比較し、Systemに適したDR Strategyを設計します。

Backupについては、対象Data、取得頻度、Retention、保存先を設計し、必要に応じてCross-Region / Cross-Account BackupやData Replicationを組み合わせます。

また、BackupやDR環境を準備するだけでなく、Restore TestやDR Testを実施し、想定した手順と時間で実際に復旧できることを継続的に確認できる運用を設計します。

Technology Map

Technologies / Keywords

Common

RTO / RPO / Backup & Restore / Pilot Light / Warm Standby / Active-Active / Failover

AWS

Multi-AZ / Elastic Load Balancing / Amazon Route 53 / AWS Backup / Cross-Region Replication / Aurora Global Database

Azure

Availability Zones / Azure Load Balancer / Azure Backup / Azure Site Recovery / Geo-Redundant Storage

GCP

Regional Resources / Cloud Load Balancing / Backup and DR Service / Multi-Region Storage / Cross-Region Replication