연락처 정보

코스 개요

대규모 언어 모델(LLM) 개론

  • LLM의 개요
  • 정의와 중요성
  • 현재 AI 분야에서의 활용 사례

트랜스포머 아키텍처

  • 트랜스포머란 무엇이며 어떻게 작동하는가?
  • 주요 구성 요소와 특징
  • 임베딩 및 위치 인코딩
  • 다중 헤드 어텐션 메커니즘
  • 피드포워드 신경망
  • 정규화와 잔차 연결 구조

트랜스포머 모델의 유형들

  • 자가 어텐션 메커니즘 작동 방식
  • 인코더-디코더 아키텍처 이해하기
  • 위치 임베딩 활용 방법
  • BERT (양방향 트랜스포머 기반 인코더 표현 모델)
  • GPT (생성형 사전 학습 트랜스포머 모델)

성능 최적화와 주의해야 할 점들

  • 컨텍스트 길이 관리 전략
  • Mamba 및 상태 기반 모델들의 특징
  • 플래시 어텐션 기술 이해하기<\/li>
  • 희소 트랜스포머 구현 방식
  • 비전 트랜스포머의 활용법
  • 양자화 기법의 중요성 파악하기

트랜스포머 모델 개선 전략들

  • 검색 증강 텍스트 생성 기법 적용하기
  • 다중 모델 통합 활용 방법
  • ‘사고의 트리’ 구조 도입 방안

미세 조정 기법들

  • 저랭크 적응 학습 이론 살펴보기
  • QLora를 이용한 미세 조정 실전 방법

LLM의 스케일링 법칙과 최적화 방향성

  • LLM에서 스케일링 법칙이 갖는 의미
  • 데이터 및 모델 규모에 따른 확장 전략
  • 계산 자원 활용의 최적화 방안
  • 매개변수 효율성 개선 방향

최적화 기법들

  • 모델 규모, 데이터 크기, 연산 능력 및 추론 요구사항 간의 관계 파악하기
  • LLM 성능과 효율성 개선 전략 도출하기
  • 학습 및 미세 조정 시 유용한 최선의 관행과 툴 소개

LLM 학습 및 미세 조정 과정

  • 처음부터 LLM을 구축할 때의 절차와 어려움들
  • 데이터 확보 및 유지 관리 전략
  • 대규모 데이터 처리, CPU 활용, 메모리 요구사항 분석하기
  • 최적화 과정에서 발생하는 난제 파악하기
  • 오픈소스 LLM 시장 현황과 전망 살펴보기

강화 학습(RL) 기초 개론

  • 강화 학습이란 무엇인가?
  • 긍정적 보상을 통한 학습 원리 이해하기
  • 핵심 개념 및 용어 설명
  • 마르코프 결정 과정(MDP) 개요
  • 동적 계획법 활용 방법
  • 몬테카를로 방법의 특징 분석하기
  • 시간차 학습 메커니즘 살펴보기

심층 강화 학습 기술들

  • 딥 Q-네트워크(DQN) 구조 이해하기
  • 근접 정책 최적화(PPO) 알고리즘 살펴보기
  • 강화 학습에 관한 주요 요소들 파악하기

LLM과 강화 학습의 결합 방안

  • 두 기술을 융합하는 방법론 탐구하기
  • LLM에서 강화 학습이 어떻게 활용되는지 이해하기
  • 인간 피드백 기반 강화 학습(RLHF) 개념 알아보기
  • RLHF 대체 가능한 기술적 접근법 소개

실제 사례 및 응용 분야 살펴보기

  • 현실 세계에서의 활용 실례들
  • 성공적인 적용 사례와 당면 과제 분석하기

고급 주제들

  • 최신 고급 기법들 소개하기
  • 첨단 최적화 방법론 탐색하기
  • 혁신적인 연구 동향과 발전 방향 살펴보기

요약 및 향후 학습 방향 제시

요건

  • 머신 러닝에 대한 기초 지식이 필요합니다

대상 청중

  • 데이터 과학자들
  • 소프트웨어 엔지니어들
 21 시간

참가자 수


참가자별 가격

예정된 코스

관련 카테고리