본문 바로가기
문서 목차
QKS클러스터

자가치유와 복구

QKS는 클러스터를 정상 상태로 되돌리는 두 가지 수단을 제공합니다.

QUANTUM C&S

개요

QKS는 클러스터를 정상 상태로 되돌리는 두 가지 수단을 제공합니다.

구분 대상 실행 주체
자동 자가치유 워커 노드 장애 플랫폼이 자동 수행
클러스터 복구 컨트롤 플레인 구성 드리프트 운영자가 수동 실행

자동 자가치유

동작 방식

모든 클러스터에 기본으로 적용되며 별도 설정이 필요 없습니다.

  1. 워커 노드가 일정 시간 이상 응답하지 않으면 Unhealthy 로 판정됩니다.
  2. 플랫폼이 해당 노드를 자동으로 삭제합니다.
  3. 같은 사양의 대체 노드를 다시 프로비저닝합니다.
  4. 새 노드가 클러스터에 참여하면 워크로드가 다시 배치됩니다.

확인 방법

클러스터 상세 화면의 노드 목록에서 노드가 사라졌다가 새 이름으로 다시 나타납니다. 전체 과정은 Operations 화면에 작업으로 기록됩니다.

참고

자가치유는 워커 노드에만 적용됩니다. 컨트롤 플레인은 플랫폼이 별도로 관리합니다.


클러스터 복구

언제 사용하나

클러스터가 아래 상태일 때 사용합니다.

  • 상태가 Running 이 아닌 채로 오래 머무를 때
  • 노드 수가 설정한 값과 다를 때
  • 외부에서 리소스를 직접 수정해 구성이 어긋났을 때

실행 절차

  1. 클러스터 목록에서 대상 클러스터를 선택해 상세 화면을 엽니다.
  2. 복구(Repair) 버튼을 클릭합니다.
  3. 확인 창에서 승인합니다.
  4. 복구 작업이 시작되며 Operations 화면에서 진행률을 추적할 수 있습니다.

복구가 하는 일

선언된 설정과 실제 상태를 다시 맞춥니다(재동기화). 컨트롤 플레인과 노드 구성이 설정값 기준으로 재조정됩니다.

주의

복구는 데이터를 되돌리지 않습니다. 워크로드나 볼륨 데이터를 이전 시점으로 되돌리려면 백업 복원을 사용하세요.