모범 사례 및 튜토리얼

비즈니스 연속성 및 재해 복구 전략

4 분 읽기

이 게시물에서는 비즈니스 연속성(BC) 및 재해 복구(DR) 계획 수립 시 고려해야 할 몇 가지 중요한 사항을 살펴봅니다.

코어 비즈니스 서비스로 Couchbase를 사용할 때는 비즈니스 연속성에 대한 신중한 고려가 필요합니다. 오늘의 초점은 애플리케이션 계층과 서비스 영향의 원인 및 그 의미에 맞춰져 있습니다.

Couchbase를 영구적인 레코드 시스템(System of Record)으로 사용할 때, 고가용성 합의된 서비스 수준(SLA)을 충족하기 위해 HA, DR, BC를 면밀히 이해해야 합니다.

서비스 중단과 다운타임이 비즈니스에 심각한 타격을 줄 수 있는 세상에서, 기업은 내부 및 외부 이해관계자와 고객 모두에 대한 비즈니스 영향을 최소화하기 위해 강력하게 보호되고 있는지 확인해야 합니다.

게다가 데이터베이스는 일반적으로 비즈니스 운영에 매우 중요하며 기업의 애플리케이션 생태계에서 핵심적인 역할을 합니다. 데이터베이스가 다운되면 그 장애는 다른 서비스에도 영향을 미칩니다. 이러한 영향의 중요성은 예상치 못한 서비스 중단으로부터 보호해야 하는 이유를 확고히 해줍니다.

역사적으로 기업들은 99.9%의 서비스 가동 시간에 만족했습니다. 이제 조직들은 99.9999% 또는 연간 31초에 해당하는 식스 나인즈 이상의 가동 시간을 추구하고 있습니다. 과거에는 기업들이 몇 시간 동안의 중단은 용인할 수 있었지만, 더 이상은 그렇지 않으므로 비즈니스 요구 사항을 이해하는 것이 필수적입니다.

비즈니스 요구 사항을 충족하기 위한 전략을 설계하기 전에, 우리는 먼저 서비스 수준 협약(SLA)과 그 측정 방식을 이해해야 합니다.

SLA는 합의된 시간 내에 서비스를 실행할 수 있도록 고객에게 약속하는 것입니다.

중요한 것에 기준을 두고 SLA 측정하기

우리는 또한 가용성과 SLA가 일반적으로 측정되는 지표를 이해해야 하며, 주로 두 가지가 있습니다:

복구 시점 목표

“내가 감당할 수 있는 데이터 손실의 양은 어느 정도인가요?”

  •   고장이 발생한 시점으로부터 시간의 역방향으로 표현됨.
  •   초, 분, 시간 또는 일 단위로 지정할 수 있습니다.

복구 목표 시간

“서비스 중단을 얼마나 감당할 수 있나요?”

  •   데이터를 다시 사용할 수 있게 되기까지 얼마나 걸리나요?
  •   재난의 결과로 정전이 정상적인 운영을 방해하는 정도와 단위 시간당 손실되는 수익의 양에 대한 함수.
  •   초, 분, 시간 또는 일 단위로 지정할 수 있습니다.

따라서 우리가 HA/DR 및 BC에 대해 이야기할 때 달성하고자 하는 것은 무엇입니까? 이는 비즈니스 운영을 중단시키는 사건이 발생한 후, 핵심 비즈니스 애플리케이션 관점에서 정상적인(또는 정상에 가까운) 비즈니스 운영을 복구할 수 있는 역량입니다. 본질적으로 원하는 RPO/RTO 요구 사항을 충족하는 것입니다.

서비스 장애 원인 파악하기

또한 서비스 실패의 해부학적 구조, 즉 원인과 과정을 고려해야 하며, 이는 서비스 보호 방식에 영향을 미치기 때문입니다.

인용된 응용 프로그램/서비스 장애 원인(아래)은 각각 서로 다른 영향과 의미를 가지며, 완전한 보호를 보장하기 위해 종종 서로 다른 해결책, 고려 사항 및 구성을 필요로 합니다.

검토해야 할 또 다른 중요한 고려 사항은 서비스 중단이 직접적인 매출 손실에만 영향을 미친다는 잘못된 통념입니다. 많은 시스템이 수익을 창출하는 시스템이 아니기 때문에 대개는 그렇지 않습니다. 이를 더 넓게 보면, 비즈니스 연속성 솔루션을 마련해야 하는 이유는 훨씬 더 많습니다.

  • 평판 또는 브랜드 손상
  • 경쟁사 또는 공급업체로의 사업 손실
  • 생산성 저하 – 팀들이 내부적으로 기능과 서비스를 수행하지 못함
  • 규제 당국의 재정적 제재 – 거래가 금지될 가능성
  • 사망! 수술 및 치료 취소를 유발하는 병원/의료 체계의 붕괴
  • 다른 내부 서비스에 미치는 영향

 

완화 옵션

그렇다면 애플리케이션 서비스 중단을 방지하고 완화하기 위한 선택지에는 어떤 것들이 있나요:

  • 클러스터링 – 단일 장애 지점을 방지하기 위한 다중 노드 구성
  • 복제 – 여러 위치와 지역에서 애플리케이션과 데이터를 사용할 수 있도록 보장하는 것
  • 백업 – 파괴적인 사고로부터 복구하기 위함

이러한 각 옵션은 서비스 중단으로부터 보호하고 정상적인 비즈니스 서비스의 복구를 돕는 데 기여할 수 있습니다. 또한 이들 각각은 비즈니스에 요구되는 SLA에 반드시 고려되어야 하는 서로 다른 RPO 및 RTO에 대한 영향을 가지고 있습니다.

Couchbase의 핵심 신조 중 하나이자 우리의 DNA라고 할 수 있는 것은, 높은 가용성을 갖추고, 복원력을 제공하며, SLA가 준수되도록 보장하도록 설계되었다는 점입니다.

카우치베이스는 서비스 중단을 완화하고 다운타임을 최소화하기 위해 완전히 설계 및 통합된 이 세 가지 솔루션(클러스터링, 복제, 백업)을 모두 제공합니다.

전략적 가용성 

올바른 가용성 전략을 선택하는 것은 가용성과 SLA 충족에 큰 영향을 미칠 것이라는 점을 기억하십시오. 필요한 SLA를 이해하고 정의하는 것이 매우 중요합니다. 

서비스 중단 이후에 재검토하는 것보다 애초에 초기 전략을 올바르게 세우는 것이 낫습니다.

비용 영향과 자금 조달 주체를 고려하는 동시에, 회복 기간에 대해서는 현실적이어야 합니다.

첫 번째 단계는 비즈니스 목표와 애플리케이션 요구 사항을 파악하는 것입니다. 그로부터 서비스 수준 협약(SLA)과 기업의 목표를 충족할 수 있는 방안을 조사하십시오.

다음에는 카우치베이스가 클러스터링을 통해 솔루션을 고가용성으로 만드는 방법에 대해 살펴보겠습니다.

 

이 기사 공유하기

작가

댓글 남기기

카우치베이스 카펠라를 시작할 준비가 되셨나요?

개발 시작하기

NoSQL을 탐색하고, 리소스를 찾아보고, 튜토리얼을 시작하려면 개발자 포털을 확인하세요.

카펠라 프리 사용하기

단 몇 번의 클릭으로 카우치베이스(Couchbase)를 직접 체험해 보세요. Capella DBaaS는 시작하기 가장 쉽고 빠른 방법입니다.

연락해

Couchbase 제품군에 대해 더 알고 싶으신가요? 저희가 도와드리겠습니다.