AWS CloudWatch
AWS 리소스들의 상태를 수집하고 모니터링하는 서비스
핵심 개념
- Metric: 시간에 따라 변하는 숫자(CPU 사용률, 요청 수)
- Log Group: 로그 저장 단위
- Dashboard: 지표 시각화 화면
Alarm
특정 지표에 기준을 설정해두고 자동화된 대응 조치를 수행하는 것
예시
- 'CPU 사용률이 80%를 넘으면 즉시 담당자 슬랙이나 이메일로 경고를 보내라'
- '트래픽이 폭주하면 자동으로 서버를 여러 대 더 띄워라(Auto Scaling)'
CloudWatch 지표 확인 예

