문서 목차
QKS클러스터
자가치유와 복구
QKS는 클러스터를 정상 상태로 되돌리는 두 가지 수단을 제공합니다.
QUANTUM C&S
개요
QKS는 클러스터를 정상 상태로 되돌리는 두 가지 수단을 제공합니다.
| 구분 | 대상 | 실행 주체 |
|---|---|---|
| 자동 자가치유 | 워커 노드 장애 | 플랫폼이 자동 수행 |
| 클러스터 복구 | 컨트롤 플레인 구성 드리프트 | 운영자가 수동 실행 |
자동 자가치유
동작 방식
모든 클러스터에 기본으로 적용되며 별도 설정이 필요 없습니다.
- 워커 노드가 일정 시간 이상 응답하지 않으면
Unhealthy로 판정됩니다. - 플랫폼이 해당 노드를 자동으로 삭제합니다.
- 같은 사양의 대체 노드를 다시 프로비저닝합니다.
- 새 노드가 클러스터에 참여하면 워크로드가 다시 배치됩니다.
확인 방법
클러스터 상세 화면의 노드 목록에서 노드가 사라졌다가 새 이름으로 다시 나타납니다. 전체 과정은 Operations 화면에 작업으로 기록됩니다.
참고
자가치유는 워커 노드에만 적용됩니다. 컨트롤 플레인은 플랫폼이 별도로 관리합니다.
클러스터 복구
언제 사용하나
클러스터가 아래 상태일 때 사용합니다.
- 상태가
Running이 아닌 채로 오래 머무를 때 - 노드 수가 설정한 값과 다를 때
- 외부에서 리소스를 직접 수정해 구성이 어긋났을 때
실행 절차
- 클러스터 목록에서 대상 클러스터를 선택해 상세 화면을 엽니다.
- 복구(Repair) 버튼을 클릭합니다.
- 확인 창에서 승인합니다.
- 복구 작업이 시작되며 Operations 화면에서 진행률을 추적할 수 있습니다.
복구가 하는 일
선언된 설정과 실제 상태를 다시 맞춥니다(재동기화). 컨트롤 플레인과 노드 구성이 설정값 기준으로 재조정됩니다.
주의
복구는 데이터를 되돌리지 않습니다. 워크로드나 볼륨 데이터를 이전 시점으로 되돌리려면 백업 복원을 사용하세요.