본문 바로가기
문서 목차
QKS · Monitoring

노드 모니터링

Monitoring Nodes 페이지에서 클러스터 내 모든 노드의 리소스 사용 현황을 실시간으로 모니터링할 수 있습니다. CPU, 메모리, 디스크, 네트워크 지표를 시계열 그래프로 확인하고, 노드 이상 징후를 조기에 감지할 수 있습니다.

QUANTUM C&S

개요

Monitoring > Nodes 페이지에서 클러스터 내 모든 노드의 리소스 사용 현황을 실시간으로 모니터링할 수 있습니다. CPU, 메모리, 디스크, 네트워크 지표를 시계열 그래프로 확인하고, 노드 이상 징후를 조기에 감지할 수 있습니다.


노드 목록

노드 목록에서 각 노드의 현재 상태와 리소스 사용률을 한눈에 확인할 수 있습니다.

항목 설명
노드 이름 노드의 식별자
상태 Ready / NotReady
역할 control-plane / worker
CPU 사용률 현재 CPU 사용량 (%)
메모리 사용률 현재 메모리 사용량 (%)
디스크 사용률 루트 디스크 사용량 (%)
업타임 노드가 실행된 시간

노드 상세 메트릭

노드를 클릭하면 해당 노드의 시계열 메트릭 그래프를 확인할 수 있습니다.

CPU

  • CPU 사용률 (%): 전체 CPU 사용률 추이
  • CPU 사용률 by 모드: user, system, iowait, idle 별 분류

메모리

  • 메모리 사용량: 사용 중인 메모리, 캐시, 버퍼
  • 메모리 가용량: 현재 사용 가능한 메모리
  • Swap 사용량: Swap 사용 여부 (Swap 사용이 높으면 메모리 부족 징후)

디스크

  • 디스크 사용률: 파티션별 사용 현황
  • 디스크 I/O: 초당 읽기/쓰기 바이트
  • I/O 대기 (iowait): 디스크 I/O 대기 비율 (높으면 디스크 병목)

네트워크

  • 수신 트래픽 (rx): 네트워크 인터페이스별 수신 대역폭
  • 송신 트래픽 (tx): 네트워크 인터페이스별 송신 대역폭
  • 패킷 드롭: 드롭된 네트워크 패킷 수

시간 범위 선택

메트릭 그래프의 조회 시간 범위를 선택할 수 있습니다:

범위 적합한 상황
최근 1시간 현재 이슈 실시간 분석
최근 6시간 최근 변경 사항의 영향 파악
최근 24시간 하루 트래픽 패턴 파악
최근 7일 장기 용량 계획 및 트렌드 분석

kubectl로 노드 리소스 확인

# 노드 리소스 사용량 (실시간)
kubectl top nodes

# 노드 상세 정보 (할당 가능 리소스, 조건 포함)
kubectl describe node <node-name>

# 노드에 예약된 리소스 현황
kubectl get node <node-name> -o json | \
  jq '.status.allocatable'

노드 이상 대응 가이드

CPU 사용률이 지속적으로 높은 경우

  1. 어떤 파드가 CPU를 많이 사용하는지 확인합니다:
       kubectl top pods -A --sort-by=cpu
    
  2. 해당 파드의 CPU 제한(limit)이 적절한지 검토합니다.
  3. 노드 스케일 아웃 또는 새 노드 풀 추가를 고려합니다.

메모리 사용률이 지속적으로 높은 경우

  1. 메모리를 많이 사용하는 파드를 확인합니다:
       kubectl top pods -A --sort-by=memory
    
  2. OOMKilled 파드가 있는지 확인합니다:
       kubectl get pods -A | grep OOM
    
  3. 파드의 메모리 limit를 조정하거나, 노드 사양을 업그레이드합니다.