연락처 정보

코스 개요

I. Lustre 기술 개요

1. Lustre 기술 개요

  • 병렬 파일 시스템 및 HPC 스토리지 요구사항 소개
  • 고성능 컴퓨팅 환경에서 Lustre의 역할
  • Lustre의 진화 및 아키텍처
  • 전통적인 분산 파일 시스템 및 네트워크 파일 시스템과의 비교
  • 일반적인 Lustre 배포 시나리오

2. Lustre 기능 및 능력

  • 높은 처리량 병렬 I/O
  • 대규모 컴퓨팅 환경을 위한 확장성
  • 메타데이터와 데이터 분리 개념
  • 성능 특징 및 제한 사항
  • HPC 클러스터 및 과학적 워크로드와의 통합

II. Lustre 아키텍처 및 핵심 구성 요소

1. Lustre 시스템 아키텍처

  • Lustre 클라이언트/서버 아키텍처 이해
  • Lustre 구성 요소 개요:
    • 메타데이터 서버 (MDS)
    • 메타데이터 대상 (MDT)
    • 객체 스토리지 서버 (OSS)
    • 객체 스토리지 대상 (OST)
    • Lustre 클라이언트

2. Lustre 데이터 관리 개념

  • 파일 스트라이핑 및 객체 스토리지 원칙
  • 메타데이터 작업
  • 데이터 배치 전략
  • 논리적 스토리지 구성

III. 하드웨어 계획 및 환경 준비

1. Lustre 스토리지 인프라 설계

  • 하드웨어 구성 요소 선택
  • 스토리지 서버 요구사항
  • 디스크 기술 및 RAID 고려 사항
  • 네트워크 인프라 계획
  • 용량 및 성능 계획

2. 운영 환경 준비

  • 지원되는 운영 체제
  • 커널 및 드라이버 요구사항
  • 네트워크 구성 요구사항
  • 서버 및 클라이언트 준비

IV. Lustre 설치 및 구성

1. Lustre 설치 프로세스

  • Lustre 소프트웨어 패키지 설치
  • 저장소 및 의존성 구성
  • 서버 및 클라이언트 노드 준비
  • Lustre 서비스 초기화

2. Lustre 파일 시스템 생성

  • 메타데이터 및 객체 스토리지 대상 포맷팅
  • 파일 시스템 매개변수 구성
  • Lustre 클라이언트 마운트
  • 설치 유효성 검사

V. Lustre 네트워크 관리

1. Lustre 네트워크 아키텍처

  • LNet(Lust Networking) 개요
  • 지원되는 네트워크 기술
  • 네트워크 인터페이스 구성
  • 다중 네트워크 경로 관리

2. 네트워크 성능 최적화

  • 네트워크 튜닝 전략
  • 대역폭 및 레이턴시 고려 사항
  • 네트워크 통신 문제 해결

VI. 파일 레이아웃, 스토리지 관리 및 공간 관리

1. 파일 레이아웃 관리

  • 스트라이핑 개념 이해
  • 스트라이프 수, 크기 및 배치 구성
  • 워크로드를 위한 레이아웃 최적화

2. 스토리지 용량 관리

  • OST 활용률 모니터링
  • 스토리지 사용량 균형 맞추기
  • 스토리지 풀 관리
  • Lustre 용량 확장

VII. Lustre I/O 성능 관리

1. Lustre I/O 작업 이해

  • 병렬 I/O 개념
  • 메타데이터 대 데이터 성능
  • 클라이언트 측 캐싱
  • I/O 패턴 및 워크로드 특징

2. 성능 최적화 기술

  • 스트라이프 구성 튜닝
  • 애플리케이션 워크로드 최적화
  • 메타데이터 성능 향상
  • I/O 병목 현상 감소

VIII. Lustre 보안 및 접근 관리

1. Lustre 환경 보안

  • 사용자 및 그룹 관리
  • 인증 개념
  • 네트워크 보안 고려 사항
  • 데이터 접근 보호

2. 접근 제어 관리

  • 파일 권한
  • ACL 구성
  • 보안 모범 사례

IX. 할당량 및 리소스 제어 관리

1. Lustre 할당량 관리

  • 사용자 및 그룹 할당량 이해
  • 할당량 설정 구성
  • 할당량 사용 모니터링
  • 할당량 위반 처리

2. 용량 거버넌스

  • 스토리지 소비 관리
  • 리소스 할당 계획

X. 고가용성 및 신뢰성

1. 고성능 Lustre 시스템 설계

  • 고가용성 개념
  • 페일오버 아키텍처
  • 메타데이터 서버冗余
  • 서비스 복구 메커니즘

2. 시스템 상태 모니터링

  • 장애 감지
  • 저하 상태 관리
  • 복구 절차

XI. 모니터링, 벤치마킹 및 성능 분석

1. Lustre 모니터링 도구

  • 시스템 성능 모니터링
  • 서버 및 클라이언트 상태 확인
  • 운영 통계 수집
  • 병목 현상 식별

2. Lustre 성능 벤치마킹

  • 성능 테스트 원칙
  • 벤치마킹 도구 및 방법론
  • 처리량 및 레이턴시 측정
  • 벤치마크 결과 해석

XII. 백업, 복구 및 데이터 보호

1. Lustre용 백업 전략

  • 백업 계획 고려 사항
  • 메타데이터 및 사용자 데이터 보호
  • 스냅샷 및 복제 개념

2. 복구 작업

  • Lustre 서비스 복원
  • 장애로부터 복구
  • 데이터 무결성 유효성 검사

XIII. Lustr 업그레이드 및 유지보수

1. Luste 업그레이드 계획

  • 업그레이드 환경 준비
  • 호환성 고려 사항
  • 업그레이드 절차

2. 시스템 유지보수

  • 패치 적용
  • 구성 변경 관리
  • 다운타임 최소화

XIV. 운영 환경에서 Luste 문제 해결

1. 문제 해결 방법론

  • Lustre 로그 이해
  • 일반적인 장애 패턴 식별
  • 진단 명령어 및 도구

2. 일반적인 Lustre 문제

  • 네트워크 통신 장애
  • 메타데이터 성능 문제
  • OST 장애
  • 클라이언트 마운트 문제
  • 성능 저하

XV. 최종 워크샵 및 과정 요약

1. 엔드투엔드 Lustre 관리 연습

  • 아키텍처 설계 검토
  • Luste 배포 및 구성
  • 시스템 성능 모니터링
  • 운영 문제 해결

2. 요약 및 모범 사례

  • 핵심 관리 개념
  • 운영 배포 권장 사항
  • 성능 최적화 체크리스트
  • 질문 응답 및 지식 검토

요건

  • 스오리지 개념에 대한 이해

대상자

  • 시스템 관리자
  • 네트워크 관리자
  • 시스템 아키텍트
  • 시스템 개발자
 21 시간

참가자 수


참가자별 가격

회원 평가 (3)

예정된 코스

관련 카테고리