easydong

[Kubernetes] HPA 완전 정리: Pod 오토스케일링 메커니즘과 실무 패턴

📌 들어가며 트래픽은 하루 종일 일정하지 않다. 낮에는 몰리고 밤에는 한산하며, 이벤트가 열리면 순식간에 몇 배로 뛴다. 이때 Pod 개수를 사람이 손으로 늘렸다 줄였다 하는 건 현실적이지 않다. HPA(Horizontal Pod Autoscaler)는 이 일을 자동으로 해주는 쿠버네티스의 오토스케일링 컨트롤러다. HPA 한 줄 요약 CPU·...

[Kubernetes] 워커 노드 추가 완전 정리: 쌩 서버 vs AMI 복제

📌 들어가며 이번 글에서는 기존 클러스터에 워커 노드를 추가하는 두 가지 방법 — 쌩 서버(깡통)부터 세팅하는 방식과 AMI 복제 방식을 정리한다. 각 절차와, 특히 AMI 복제 시 놓치기 쉬운 machine-id 재생성·kubeadm reset을 짚는다. 두 방식 비교 — 쌩 서버는 깨끗하지만 30~60분 걸리고, AMI 복제는 10~20분...

[Monitoring] Prometheus PromQL 쿼리 모음: Kubernetes 트러블슈팅 지표 정리

📌 들어가며 이번 글에서는 TCP Reset 분석과 쿠버네티스 트러블슈팅에서 실제로 쓴 PromQL 쿼리를 목적별로 정리한다. TCP·리소스·네트워크·API Server 지표부터, 실제 Traefik CPU Throttling 장애 분석 사례와 단계별 체크리스트까지 다룬다. 왜 지표를 목적별로 묶나? 장애가 나면 “무슨 쿼리를 던져야 할지”가...