문서 목차
QKS · Monitoring
노드 모니터링
Monitoring Nodes 페이지에서 클러스터 내 모든 노드의 리소스 사용 현황을 실시간으로 모니터링할 수 있습니다. CPU, 메모리, 디스크, 네트워크 지표를 시계열 그래프로 확인하고, 노드 이상 징후를 조기에 감지할 수 있습니다.
QUANTUM C&S
개요
Monitoring > Nodes 페이지에서 클러스터 내 모든 노드의 리소스 사용 현황을 실시간으로 모니터링할 수 있습니다. CPU, 메모리, 디스크, 네트워크 지표를 시계열 그래프로 확인하고, 노드 이상 징후를 조기에 감지할 수 있습니다.
노드 목록
노드 목록에서 각 노드의 현재 상태와 리소스 사용률을 한눈에 확인할 수 있습니다.
| 항목 | 설명 |
|---|---|
| 노드 이름 | 노드의 식별자 |
| 상태 | Ready / NotReady |
| 역할 | control-plane / worker |
| CPU 사용률 | 현재 CPU 사용량 (%) |
| 메모리 사용률 | 현재 메모리 사용량 (%) |
| 디스크 사용률 | 루트 디스크 사용량 (%) |
| 업타임 | 노드가 실행된 시간 |
노드 상세 메트릭
노드를 클릭하면 해당 노드의 시계열 메트릭 그래프를 확인할 수 있습니다.
CPU
- CPU 사용률 (%): 전체 CPU 사용률 추이
- CPU 사용률 by 모드: user, system, iowait, idle 별 분류
메모리
- 메모리 사용량: 사용 중인 메모리, 캐시, 버퍼
- 메모리 가용량: 현재 사용 가능한 메모리
- Swap 사용량: Swap 사용 여부 (Swap 사용이 높으면 메모리 부족 징후)
디스크
- 디스크 사용률: 파티션별 사용 현황
- 디스크 I/O: 초당 읽기/쓰기 바이트
- I/O 대기 (iowait): 디스크 I/O 대기 비율 (높으면 디스크 병목)
네트워크
- 수신 트래픽 (rx): 네트워크 인터페이스별 수신 대역폭
- 송신 트래픽 (tx): 네트워크 인터페이스별 송신 대역폭
- 패킷 드롭: 드롭된 네트워크 패킷 수
시간 범위 선택
메트릭 그래프의 조회 시간 범위를 선택할 수 있습니다:
| 범위 | 적합한 상황 |
|---|---|
| 최근 1시간 | 현재 이슈 실시간 분석 |
| 최근 6시간 | 최근 변경 사항의 영향 파악 |
| 최근 24시간 | 하루 트래픽 패턴 파악 |
| 최근 7일 | 장기 용량 계획 및 트렌드 분석 |
kubectl로 노드 리소스 확인
# 노드 리소스 사용량 (실시간)
kubectl top nodes
# 노드 상세 정보 (할당 가능 리소스, 조건 포함)
kubectl describe node <node-name>
# 노드에 예약된 리소스 현황
kubectl get node <node-name> -o json | \
jq '.status.allocatable'
노드 이상 대응 가이드
CPU 사용률이 지속적으로 높은 경우
- 어떤 파드가 CPU를 많이 사용하는지 확인합니다:
kubectl top pods -A --sort-by=cpu - 해당 파드의 CPU 제한(limit)이 적절한지 검토합니다.
- 노드 스케일 아웃 또는 새 노드 풀 추가를 고려합니다.
메모리 사용률이 지속적으로 높은 경우
- 메모리를 많이 사용하는 파드를 확인합니다:
kubectl top pods -A --sort-by=memory - OOMKilled 파드가 있는지 확인합니다:
kubectl get pods -A | grep OOM - 파드의 메모리 limit를 조정하거나, 노드 사양을 업그레이드합니다.