문의를 보내주셔서 감사합니다! 팀원이 곧 연락드리겠습니다.
예약을 보내주셔서 감사합니다! 저희 팀 멤버 중 한 분이 곧 연락드리겠습니다.
코스 개요
오픈소스 기반 AIOps 아키텍처 설계 방법
- 오픈소스 AIOps 파이프라인에 필요한 핵심 구성 요소들 살펴보기
- 데이터가 수집되어 알림까지 전달되는 과정 이해하기
- 다양한 도구들의 특징 비교 및 통합 전략 수립하기
데이터 수집 및 집계 방법
- Prometheus를 활용해 시계열 데이터를 수집하는 법
- Logstash와 Beats로 로그 데이터를 캡처하는 방법
- 다양한 출처의 데이터를 상호 연관시킬 수 있도록 정규화하는 기법
모니터링 대시보드 구축 방법
- Grafana로 메트릭 데이터를 시각화하는 법
- 로그 분석을 위한 Kibana 대시보드 제작 방법
- Elasticsearch 쿼리를 활용해 운영상의 인사이트를 도출하는 방법
이상 탐지 및 장애 예측 기법
- 모니터링 데이터를 Python 환경으로 내보내는 절차
- 이상 현상 감지 및 미래 상황 예측을 위한 머신러닝 모델 훈련 방법
- 실제 운영 환경에서 실시간 추론이 가능하도록 모델 배포하는 방법
오픈소스 도구를 활용한 알림 및 자동화 기법
- Prometheus의 알림 규칙 설정 방법과 Alertmanager을 통한 라우팅 정책 이해하기
- 스크립트나 API 워크플로우를 활용해 자동 대응 조치를 실행하는 법
- Ansible, Rundeck와 같은 오픈소스 오케스트레이션 도구 사용법
통합 및 확장성 고려사항
- 대량의 데이터 수집 처리와 장기 보관 전략
- 오픈소스 시스템 환경에서의 보안 및 접근 제어 방안
- 각 계층(데이터 수집, 처리, 알림)을 독립적으로 확장하는 기법
실제 적용 사례와 추가 기능 개발 방향
- 성능 최적화, 중단 시간 예방 및 비용 절감을 위한 실전 사례 분석
- 트레이싱 도구나 서비스 그래프 등을 활용해 파이프라인 확장 방법
- 프로덕션 환경에서 AIOps 시스템을 안정적으로 운영하고 유지보수하기 위한 모범 사례들
마무리 및 향후 학습 방향 제시
요건
- Prometheus 또는 ELK와 같은 모니터링 도구 사용 경험
- Python 활용 능력 및 머신러닝 기초 지식
- IT 운영 환경과 알림 시스템에 대한 이해
대상 수강생
- 숙련된 사이트 신뢰성 엔지니어(SRE)
- 운영 업무에 종사하는 데이터 엔지니어
- DevOps 플랫폼 리더 및 인프라 아키텍트
14 시간