ABOUT ME

-

Today
-
Yesterday
-
Total
-
  • 장애 대응 1 - 모니터링
    연습장 2024. 8. 21. 15:09

    1. 장애 식별

    가장 좋지 않은 장애 식별은 고객으로부터 전달되는 장애 식별임

     

    1.1 모니터링

    1.1.1 시스템 모니터링

    - 리소스 사용량 추적: 조기 식별이 중요.

    - 서버 애플리케이션 상태:

    - 장애 예측:

     

    1.1.2 애플리케이션 모니터링

    - 로그 모니터링:

    - 성능 모니터링:

    - 서비스 헬스체크:

     

    1.1.3 사용자 경험 모니터링

    - 엔드 투 엔드 모니터링: ex. 셀레니움

    - 사용자 피드백 수집:

    - 리얼 유저 모니터링: ex. 구글 애널리틱스

     

    1.1.4 알림 및 경고 시스템

    - 알림 설정:

    - 경고 기준:

    - 알림 자동화:

     

    1.1.5 모니터링 도구

    - Prometheus & Grafana: 오픈 소스 모니터링 및 경고 툴. 제일 많이 사용. 시각적으로 분석하는 것이 유용하기 때문

    - ELK 스택(Elasticsearch, Logstash, Kibana):

    - New Relic:

     

    1.1.6 모니터링 고려사항

    - 지속적인 모니터링 및 개선: 모니터링 시스템을 최신 상태로 유지(무조건 최신버전이 좋은 건 아님)

    - 중앙 집중식 로그 관리:

    - 협업과 공유:

    - 테스트 및 시뮬레이션:

     

     

     

    '연습장' 카테고리의 다른 글

    장애 대응 3 - 장애 복구  (0) 2024.08.21
    장애 대응 2 - 장애 분석 및 진단  (0) 2024.08.21
    XSS(Cross Site Scripting)  (0) 2024.08.20
    CSRF(Cross Site Request Forgery)  (0) 2024.08.20
    모니터링  (0) 2024.08.20
Designed by Tistory.