-
장애 대응 1 - 모니터링연습장 2024. 8. 21. 15:09
1. 장애 식별
가장 좋지 않은 장애 식별은 고객으로부터 전달되는 장애 식별임
1.1 모니터링
1.1.1 시스템 모니터링
- 리소스 사용량 추적: 조기 식별이 중요.
- 서버 애플리케이션 상태:
- 장애 예측:
1.1.2 애플리케이션 모니터링
- 로그 모니터링:
- 성능 모니터링:
- 서비스 헬스체크:
1.1.3 사용자 경험 모니터링
- 엔드 투 엔드 모니터링: ex. 셀레니움
- 사용자 피드백 수집:
- 리얼 유저 모니터링: ex. 구글 애널리틱스
1.1.4 알림 및 경고 시스템
- 알림 설정:
- 경고 기준:
- 알림 자동화:
1.1.5 모니터링 도구
- Prometheus & Grafana: 오픈 소스 모니터링 및 경고 툴. 제일 많이 사용. 시각적으로 분석하는 것이 유용하기 때문
- ELK 스택(Elasticsearch, Logstash, Kibana):
- New Relic:
1.1.6 모니터링 고려사항
- 지속적인 모니터링 및 개선: 모니터링 시스템을 최신 상태로 유지(무조건 최신버전이 좋은 건 아님)
- 중앙 집중식 로그 관리:
- 협업과 공유:
- 테스트 및 시뮬레이션:
'연습장' 카테고리의 다른 글
장애 대응 3 - 장애 복구 (0) 2024.08.21 장애 대응 2 - 장애 분석 및 진단 (0) 2024.08.21 XSS(Cross Site Scripting) (0) 2024.08.20 CSRF(Cross Site Request Forgery) (0) 2024.08.20 모니터링 (0) 2024.08.20