IBM Cloud 고가용성 및 이중화를 보장하는 방법
IBM Cloud® 는 글로벌 전략, 가용성 및 비즈니스 연속성 요구사항에 따라 워크로드와 애플리케이션을 배포할 수 있는 글로벌 인프라와 클라우드 서비스 포트폴리오를 제공합니다.
이중화를 통한 고가용성
IBM Cloud 서비스는 여러 IBM Cloud 지역 및 데이터센터의 위치와 가용성 범위에 따라 서로 다른 중복 배포 및 장애 격리 패턴으로 설계됩니다.
IBM Cloud 클라우드 서비스가 어떻게 설계되고 전 세계 IBM Cloud 위치에 배포되는지 이해하면 서비스 종속성과 위치를 적절히 선택하여 워크로드와 애플리케이션의 고가용성을 보장하는 데 도움이 됩니다.
서로 다른 영역과 지역은 어떤 수준의 복원력을 제공하나요?
단일 영역 또는 다중 영역 데이터 센터는 모두 다음을 제공하여 영역과 지역 간의 단일 장애 지점(SPOF)을 방지합니다:
- 여러 개의 전원 공급 장치
- 파이버 링크
- 전용 발전기
- 배터리 백업
모든 데이터센터에는 여러 개의 전원 공급 장치가 있지만, 일부 성숙한 사이트에는 이중 전원 공급 장치를 수용하지 못할 수 있는 1U 단일 소켓 서버 섀시가 있습니다. 이러한 사이트 중 하나에 1U 단일 소켓 서버가 있는 경우 이중 전원 공급 장치가 있는 2U 섀시를 고려할 수 있습니다. 가용성 구역에 대한 자세한 정보는 리소스 배치 위치를 참조하십시오.
고가용성 및 복원력을 위한 IBM Cloud 서비스 아키텍처
{ IBM Cloud 서비스는 다음 아키텍처 패턴을 구현하여 분산된 IBM Cloud 인프라에 영향을 줄 수 있는 다양한 장애 유형에 대한 고가용성 및 복원력을 달성하도록 설계되었습니다.
제어 플레인 오류로부터 서비스 데이터 플레인 보호
IBM Cloud 서비스 아키텍처는 데이터 플레인과 제어 플레인을 위한 구성 요소를 분리합니다.
데이터 플레인 구성 요소는 서비스의 주요 기능을 제공하는 역할을 담당합니다. 데이터 플레인 구성 요소는 데이터 처리, 지속성, 로드 밸런싱 등을 구현하는 등 사용자 및 클라이언트 애플리케이션의 요청을 처리합니다.
예를 들어 다음은 데이터 플레인 책임입니다:
- 가상 서버 인스턴스(VSI) 실행 및 호스팅
- 블록 스토리지 볼륨에 대한 읽기 및 쓰기
- Object Storage 버킷에 개체 가져오기 및 설정하기
- IBM Cloud Databases for PostgreSQL 실행, 쿼리 처리 및 업데이트
컨트롤 플레인 구성 요소는 데이터 플레인 구성 요소가 작동하도록 관리하고 구성하는 역할을 담당합니다. 컨트롤 플레인 구성 요소는 관리자의 요청을 처리하여 서비스 인스턴스의 리소스 생성, 구성, 업그레이드, 폐기 단계를 통해 데이터 플레인 수명 주기를 관리합니다.
예를 들어 다음은 컨트롤 플레인의 책임입니다:
- 계정에 VSI를 나열하고 새 VSI 프로비저닝, OS 이미지에서 가상 머신 생성, 블록 스토리지 생성, 네트워크 엔드포인트의 연결 및 구성을 오케스트레이션합니다
- 블록 스토리지 볼륨 구성, 크기 조정 및 마운트하기
- 새 Object Storage 버킷 만들기
복원력과 비즈니스 연속성을 향상시키기 위해 서비스 데이터 플레인은 제어 플레인에 장애가 발생하더라도 기본 기능을 계속 제공하도록 설계되었습니다. 예를 들어, 인프라 리소스에 대한 데이터 플레인 액세스는 프로비저닝된 경우 컨트롤 플레인에 대한 종속성이 없으므로 컨트롤 플레인 문제의 영향을 받지 않습니다.
컨트롤 플레인 장애는 리소스를 생성, 수정 또는 삭제하는 기능에 영향을 미칠 수 있지만 사용 가능한 기존 리소스에는 영향을 미치지 않습니다.
영역별 서비스 독립성
구역 서비스를 사용하면 서비스 인스턴스를 멀티존 지역 또는 특정 데이터 센터의 특정 구역에 배포하도록 요청할 수 있습니다.
특정 영역 또는 특정 데이터 센터에 배포된 이러한 서비스 인스턴스는 다른 영역 또는 데이터 센터의 서비스 구성 요소에 대한 종속성 없이 해당 지역 내에서 독립적으로 구현 및 운영됩니다. 따라서 한 영역에서 장애가 발생해도 해당 영역에서 호스팅되는 인스턴스에는 영향을 미칠 수 있지만 같은 지역이나 다른 지역의 다른 영역에 있는 인스턴스에는 영향을 미치지 않습니다.
구역 서비스 아키텍처는 지역의 각 구역에 배포되고 로컬 지역 내 컨트롤 플레인 구성 요소에서 관리되는 구역 데이터 플레인을 사용합니다.
사용자 또는 애플리케이션은 각 대상 영역에 있는 영역 API 엔드포인트를 사용하여 서비스 인스턴스 함수와 상호 작용합니다.
글로벌 서비스 이중화에 설명된 일부 예외를 제외하고 서비스 제어 플레인은 데이터 플레인의 동일한 영역에 위치하며 3개의 영역에 걸쳐 배포됩니다. 다른 지역의 제어기와는 독립적입니다. 따라서 한 지역의 컨트롤 플레인 장애는 해당 지역의 서비스 기능에만 영향을 미치고 다른 지역의 서비스 기능에는 영향을 미치지 않을 수 있습니다.
한 영역에서 컨트롤 플레인에 장애가 발생하거나 영역을 사용할 수 없는 경우 리소스 생성, 구성, 업그레이드 및 폐기 등의 데이터 플레인 수명 주기 단계 관리를 위한 관리자 요청은 나머지 두 영역의 컨트롤 플레인에서 수행됩니다.
컨트롤 플레인이 전 세계에 배포되는 예외적인 경우에도 고가용성을 보장하기 위해 여러 지역에 걸쳐 배포됩니다. 따라서 한 지역에서 장애가 발생해도 다른 지역의 서비스 기능에는 영향을 미치지 않습니다.
영역 서비스를 사용하는 워크로드를 배포하기 위한 구체적인 옵션에 대한 자세한 내용은 리소스 배포 위치 및 고가용성을 위한 고려 사항을 참조하세요.
지역 서비스 이중화
지역 서비스를 사용하면 단일 대상 영역이나 데이터 센터를 지정하지 않고도 특정 지역 전체에 서비스 인스턴스를 배포할 수 있습니다.
한 지역에 배포되는 이러한 서비스 인스턴스는 동일한 지역 내 여러 영역에 배포되는 중복 구성 요소로 구현 및 운영됩니다. 이렇게 하면 지역 내 특정 영역에서 단일 장애 지점이 발생하지 않습니다.
지역 서비스 아키텍처는 지역 내 제어 플레인에서 관리되는 각 지역의 3개 영역에 배포되는 지역 데이터 플레인을 사용합니다. 한 영역에서 데이터 플레인에 장애가 발생하거나 영역을 사용할 수 없는 경우, 사용자 및 클라이언트 애플리케이션의 요청은 자동으로 나머지 두 영역의 데이터 플레인으로 라우팅됩니다.
사용자 또는 애플리케이션은 각 대상 지역에 위치한 지역 API 엔드포인트를 사용하여 서비스 인스턴스 기능과 상호 작용합니다.
글로벌 서비스 이중화에 설명된 일부 예외를 제외하고 서비스 제어 플레인은 데이터 플레인의 동일한 지역에 위치하며 다른 지역 제어 플레인과는 독립적으로 3개의 영역에 걸쳐 배포됩니다. 이렇게 하면 한 지역의 컨트롤 플레인 장애가 해당 지역의 서비스 기능에만 영향을 미치고 다른 지역의 서비스 기능에는 영향을 미치지 않을 수 있습니다.
한 영역에서 컨트롤 플레인에 장애가 발생하거나 완전히 손실된 경우, 관리자가 서비스 인스턴스의 리소스 생성, 구성, 업그레이드, 폐기 단계를 통해 데이터 플레인 수명 주기를 관리하라는 요청이 나머지 영역의 컨트롤 플레인에서 수행됩니다.
컨트롤 플레인이 전 세계에 배포되는 예외적인 경우에도 고가용성을 보장하고 한 지역의 장애가 다른 지역의 서비스 기능에 영향을 미치지 않도록 보장하기 위해 여러 지역에 걸쳐 배포됩니다.
지역 서비스를 사용하는 워크로드를 배포하기 위한 구체적인 옵션에 대한 자세한 내용은 리소스 배포 위치 및 고가용성을 위한 고려 사항을 참조하세요.
글로벌 서비스 이중화
IBM Cloud 서비스의 하위 집합은 여러 위치와 지역의 여러 지역에 걸쳐 배포되는 구성 요소와 함께 글로벌 배포 모델을 사용합니다. 이러한 서비스는 다른 지역 또는 지역 서비스가 의존하는 공통 기능을 제공합니다. 서비스 내에 글로벌 기능을 제공하는 특정 제어 플레인 컴포넌트도 있습니다.
글로벌 배포 모델을 사용하는 서비스는 여러 지역에 복제되는 구성 요소로 분산 아키텍처를 구현합니다. 구성 요소는 자동 장애 조치 설계를 통해 이러한 리전 간에 부하가 분산되어 운영자의 조치 없이도 서비스를 계속 실행할 수 있습니다.
다음 섹션에서는 글로벌 배포 모델을 사용하는 서비스와 다른 지역 또는 지역 서비스의 종속성에 대한 지역 간 영향을 자세히 설명합니다.
이 접근 방식은 아키텍처에서 단일 장애 지점을 제거하는 데 도움이 되지만 글로벌 서비스 제어 영역이 호스팅되는 지역과 다른 지역에서 운영 중인 경우에도 잠재적인 지역 간 영향을 나타낼 수 있습니다.
글로벌 플랫폼 서비스
글로벌 플랫폼 서비스는 다른 지역 또는 지역 서비스가 의존하는 공통 기능을 제공합니다. 이는 모든 IBM Cloud 글로벌 인프라에서 사용자 인터페이스, 사용자 ID 및 계정, 액세스, 청구 등을 조율하기 위한 목적으로만 사용되는 제어 플레인입니다.
글로벌 플랫폼 서비스는 글로벌 로드 밸런싱 전략을 사용하여 클라우드 서비스에 액세스하고 관리하는 데 가용성이 높은 이중화된 플랫폼을 사용할 수 있도록 지원합니다.
글로벌 플랫폼 서비스의 구성 요소가 위치한 지역의 가용성에 영향을 미치는 이벤트가 발생하면 서비스에서 제공하는 관리 기능이 저하되거나 사용할 수 없게 될 수 있습니다.
다음 표에는 글로벌 플랫폼 서비스와 해당 서비스가 제공하는 기능이 나열되어 있으며, 서비스에 대해 나열된 모든 지역에서 가용성에 영향을 미치는 이벤트가 발생하지 않는 한 영향을 받지 않습니다. 자세한 내용은 위치별 서비스 및 인프라 가용성을 참조하세요.
| Service | 관리 기능 | 고가용성 |
|---|---|---|
| 콘솔 IBM Cloud 콘솔 탐색하기 |
IBM Cloud 콘솔은 관리자가 모든 IBM Cloud 리소스 및 계정을 관리하고, 새 서비스 인스턴스를 주문하고, 가격 및 청구 정보를 보고, 지원을 받거나 상태를 확인할 수 있는 사용자 인터페이스를 제공합니다 | 활성/활성 |
| 카탈로그 카탈로그 관리 API |
카탈로그 관리 서비스를 사용하면 IBM Cloud 카탈로그와 상호 작용하여 IBM Cloud 서비스 인스턴스를 주문하고 프로비저닝할 수 있습니다. 또한 IBM Cloud 카탈로그의 공개 여부를 관리하고 계정의 사용자에 대한 공개 카탈로그 및 비공개 카탈로그의 제품 액세스를 제어할 수 있습니다. | 활성/활성 |
| 글로벌 검색 및 태깅 글로벌 검색 API, 글로벌 태깅 API |
검색 및 태그 지정 서비스를 통해 다음을 수행할 수 있습니다:
|
활성/활성 |
| ID 및 액세스 관리 IAM ID 서비스 API |
IAM 컨트롤 플레인에서는 다음을 사용할 수 있습니다:
|
활성/활성 |
| 비즈니스 지원 서비스 사용자 관리 API 사용량 측정 API 사용량 보고서 API |
비즈니스 지원 서비스를 통해 다음을 수행할 수 있습니다:
|
활성/활성 |
| IBM Cloud 프로젝트 프로젝트 API |
프로젝트 서비스에서는 다음과 같은 기능을 사용할 수 있습니다:
|
활성/활성 |
글로벌 컨트롤 플레인이 있는 서비스
서비스 내의 글로벌 컨트롤 플레인 컴포넌트는 글로벌 범위의 기능을 제공합니다. 특정 지역의 영역 및 지역 서비스를 사용하는 일부 작업은 리소스가 위치한 지역과 다른 지역에 대한 기본 종속성이 있을 수 있습니다.
글로벌 플랫폼 서비스의 구성 요소가 위치한 지역의 가용성에 영향을 미치는 이벤트가 발생하면 서비스에서 제공하는 관리 작업이 저하되거나 제공되지 않을 수 있습니다.
| Service | 제어 평면 관리 기능 | 고가용성 |
|---|---|---|
| 클래식 인프라 리소스 관리 |
인프라 리소스 관리 서비스 컨트롤 플레인에서는 다음을 수행할 수 있습니다:
|
기본/보조 |
| 공용 IP 주소 관리 | 인터넷/공용 로드 밸런서, 탄력적 IP 또는 공용 주소가 있는 가상 및 베어메탈 서버 리소스에 새 공용 IP 주소 또는 서브넷을 할당하세요. | 기본/보조 |
| IBMid 나의 IBM |
IBMid 서비스 컨트롤 플레인은 다음을 지원합니다:
|
기본/보조 |
| DNS Services DNS Services API |
DNS Services 다음을 활성화합니다:
|
기본/보조 |
| Transit Gateway Transit Gateway API |
Transit Gateway 서비스 컨트롤 플레인에서는 다음을 수행할 수 있습니다:
|
기본/보조 |
| Direct Link Direct Link API |
Direct Link 서비스 컨트롤 플레인에서는 다음을 수행할 수 있습니다:
|
기본/보조 |
| Object Storage 프로비저닝 |
{ Object Storage 서비스 컨트롤 플레인에서는 다음을 사용할 수 있습니다:
|
기본/보조 |
고가용성을 위해 플랫폼 서비스를 사용할 때의 모범 사례에 대한 자세한 내용은 다음 표를 참조하세요.
| 플랫폼 서비스 | 세부사항 |
|---|---|
| 계정 관리 | 계정 설정을 위한 우수 사례 및 비용 청구 및 사용량에 대한 우수 사례 |
| 카탈로그 | 카탈로그 설정 관리 |
| Cloud Shell | Cloud Shell의 고가용성 및 재해 복구 이해 |
| 콘솔 | 콘솔 탐색 |
| 글로벌 검색 및 태그 지정 | 리소스 검색 및 태그에 대한 작업 |
| IAM | IBM Cloud Identity and Access Management(IAM)란 무엇입니까? |
| IBM Cloud CLI | IBM Cloud CLI의 고가용성 및 재해 복구 이해 |
| IBM Cloud 프로젝트 | 프로젝트의 고가용성 및 재해 복구에 대한 이해 |
| Workload Protection | 고가용성 및 재해 복구에 대한 이해 에 대한 Workload Protection |
네트워크 백본 이중화
IBM Cloud 네트워크는 단일 장애 지점이 발생하지 않도록 설계되었습니다. 각 지역 내에서 가능한 경우 동일한 서비스 연결을 위해 다양한 통신 사업자를 사용하여 네트워크의 모든 지점에 다양한 이중화 연결이 존재합니다.
{ IBM Cloud 다양한 다크 파이버 공급자를 사용하여 엣지 사이트를 모든 지역 컴퓨팅 시설에 연결합니다. 또한 각 엣지 사이트에는 다른 지역으로 연결되는 이중화 백본이 있으며, 로컬 교환을 통해 직간접적으로 여러 제공업체와 연결됩니다.
지역 간 종속성으로부터 구역 및 지역 서비스 격리
일반적으로 한 지역의 가용성에 영향을 미치는 이벤트가 발생하면 해당 지역의 구역 및 지역 서비스만 영향을 받습니다. 다른 지역의 서비스는 영향을 받지 않습니다.
영역 및 지역 서비스의 데이터 플레인은 인프라, 컨테이너 오케스트레이션, 데이터베이스, 보안 등과 같은 필수 종속성을 포함하여 동일한 지역 내의 리소스에 의존합니다.
지역에 위치한 서비스의 데이터 플레인은 사용자가 제공하는 서비스 인스턴스에 따라 다음과 같은 서비스 간 기능을 지원합니다:
- bYOK(Bring-Your-Own-Key) 암호화 지원을 위한 Key Protect 인스턴스입니다.
- { Hyper Protect Crypto Services 인스턴스는 KYOK(키 보관) 암호화를 지원합니다.
- 백업, 보안 Control Center 증거 및 결과, 보관된 로그 등을 저장하기 위한 Object Storage 버킷, 그리고 일반적으로 대량의 데이터를 Object Storage 버킷에 저장하거나 처리하는 기능을 지원하는 모든 기능에 사용할 수 있습니다.
서비스 할당 지역을 신중하게 선택하여 가용성을 보장할 수 있도록 하세요. 지역 간 장애의 영향을 방지하려면 종속 서비스와 같은 지역에 서비스를 배치하는 것이 좋습니다.
각 서비스 설명서는 원하는 수준의 복원력을 위해 애플리케이션의 아키텍처에 따라 서비스를 사용하는 방법, 위치 및 구성 선택에 대한 명확한 지침을 제공합니다.