재해 복구를 위한 FAQ

재해 복구에 대한 FAQ에는 무엇이 재해로 간주되는지, 다른 지역에서 워크로드를 복구하는 방법에 대한 질문이 포함될 수 있습니다. IBM Cloud에 대한 모든 FAQ를 찾으려면 FAQ 라이브러리를 참조하십시오.

고가용성은 재해 복구와 같은 의미인가요? 둘 다 필수인가요?

고가용성(HA)과 재해 복구(DR)는 혼동하기 쉽지만 엄연히 다른 개념입니다.

워크로드에 고가용성을 설계하는 것은 워크로드의 장애를 방지하기 위한 노력입니다. 예를 들어 RAID 어레이의 여러 디스크에 데이터를 분산하는 것은 디스크 장애로 인한 가동 중단을 방지하기 위한 노력입니다. 서버의 다중 전원 공급 장치는 전원 회로의 정전으로 인한 장애를 방지하기 위한 노력입니다. 서로 다른 영역의 여러 서버에서 애플리케이션을 실행하는 것은 서버 장애 및 영역 장애로 인한 서비스 중단을 방지하기 위한 노력입니다.

재해 복구는 리소스를 사용할 수 있음에도 불구하고 워크로드에 장애가 발생한 후 이를 복구하는 작업입니다. 예를 들어, 워크로드가 여러 데이터 센터의 여러 하드웨어 장치에서 실행되므로 시스템의 가용성이 99.999 달하고 장애에 대한 복원력이 높을 수 있습니다. 그러나 실수나 악의적인 데이터 삭제, 모든 데이터 센터를 포함하는 광범위한 지역을 강타하는 자연재해와 같은 재해에는 여전히 취약합니다.

일반적으로 고가용성이 요구되는 워크로드일수록 비즈니스에 더 가치 있고 중요한 역할을 합니다. 워크로드는 비즈니스에 매우 중요하기 때문에 잘 문서화되고 엄격한 재해 복구 계획을 수립해야 할 필요성이 더욱 커집니다.

무엇이 재난으로 간주되나요?

IT 재해란 애플리케이션이나 환경이 심각하게 중단되어 의도한 대로 작동하지 않는 경우를 말합니다. 재난 이벤트는 단기적이거나 장기적으로 지속될 수 있지만, 일반적으로 비즈니스에 재정적, 평판적 또는 두 가지 모두에 심각한 피해를 입힙니다.

재해 이벤트는 다음 시나리오의 결과로 발생할 수 있습니다:

  • 홍수, 화재, 지진과 같은 자연재해.
  • 정전이나 광범위한 네트워크 장애와 같은 인프라 문제.
  • 데이터, 서비스 또는 구성을 삭제하는 우발적이거나 악의적인 행위.
  • 예상하지 못한 버그나 기타 오류가 포함된 소프트웨어 업데이트를 배포합니다.

각각의 경우 정해진 시간 내에 서비스를 재해 발생 이전 시점으로 복구하는 복구 계획을 수립하는 것이 필수적입니다. 또한 다운타임이 비즈니스에 미치는 영향과 복구 솔루션 비용을 포함한 비용도 고려해야 합니다.

DR을 한 지역에서만 진행할 수 있나요?

예, DR은 동일한 지역에서 수행할 수 있으며 지연 시간이 짧고 지역 간 데이터 복제가 필요하지 않으므로 더 빠를 수 있습니다. 그러나 더 나은 복원력을 위해 별도의 리전을 사용하는 것이 좋습니다. 주 지역이 심각한 영향을 받으면 같은 지역의 복구가 불가능할 수도 있습니다.

{ IBM Cloud 게시된 서비스 수준 목표(SLO) 에 따라 지역 내에서 서비스를 복구하려고 합니다. 복구에는 몇 분 또는 몇 시간이 걸릴 수도 있지만, 물리적으로 재산이 파괴된 최악의 상황에서는 며칠, 몇 주 또는 몇 달이 걸릴 수도 있습니다.

IBM Cloud _notm}}에서 IBM Cloud 재해라고 부르는 중단이 발생하는 경우, IBM Cloud 서비스를 복구해야만 워크로드를 복구할 수 있습니다. 그렇다면 IBM Cloud 복구를 완료하는 데 걸리는 시간을 회원님의 복구에 걸리는 시간에 더해야 합니다. 단일 지역에만 의존할지 여부를 결정할 때 이 점을 염두에 두세요.

모든 재해는 두 번째 지역에서 복구해야 하나요?

모든 재해가 두 번째 지역에서 복구해야 하는 것은 아닙니다. 데이터베이스 관리자가 실수로 데이터베이스 테이블을 삭제하거나 자동화된 릴리스가 잘못되거나 필수 관리형 클라우드 서비스가 제대로 작동하지 않을 수 있습니다. 이러한 경우 데이터 복구가 핵심입니다. 문제가 얼마나 광범위하게 퍼져 있는지, 조직이 얼마나 준비되어 있는지, 얼마나 빨리 복구해야 하는지에 따라 이러한 재해로 인해 다른 지역으로 장애 복구가 강제되지 않을 수도 있습니다. 시나리오에 따라 동일한 지역에서 복구가 이루어질 수도 있습니다. 계획에 여러 가지 재해 시나리오를 고려하세요.

실수로 서비스가 삭제되는 것을 방지하려면 어떻게 해야 하나요?

대부분의 IBM Cloud 서비스에는 실수로 삭제되는 것을 방지하는 안전 장치가 내장되어 있지만, 적절한 액세스 권한이 있는 계정을 사용하면 더 많은 보호 기능을 구현할 수 있습니다. Cloud Identity and Access Management (IAM)을 사용하여 다양한 수준의 액세스 및 권한이 있는 계정을 만드세요. 그런 다음 운영 작업에 적합한 계정을 사용하고 개발자 등 다른 사용자에게는 필요한 액세스 권한과 권한만 부여하세요.

Terraform을 사용하는 경우 업데이트 액세스 권한은 있지만 삭제 액세스 권한이 없는 서비스 ID를 사용하세요.