연락처 정보

코스 개요

프로덕션 환경에서의 에이전틱 시스템 기초

  • 에이전틱 아키텍처: 루프, 도구, 메모리, 오케스트레이션 레이어
  • 에이전트 라이프사이클: 개발, 배포, 지속적 운영
  • 프로덕션 규모 에이전트 관리의 과제

인프라 및 배포 모델

  • 컨테이너 및 클라우드 환경에서의 에이전트 배포
  • 스케일링 패턴: 수평 vs 수직 스케일링, 동시성, 스로틀링
  • 멀티 에이전트 오케스트레이션 및 워크로드 밸런싱

모니터링 및 관찰 가능성

  • 핵심 메트릭: 지연 시간, 성공률, 메모리 사용량, 에이전트 호출 깊이
  • 에이전트 활동 및 호출 그래프 추적
  • Prometheus, OpenTelemetry, Grafana를 활용한 관찰 가능성 계측

로깅, 감사, 컴플라이언스

  • 중앙 집중식 로깅 및 구조화 이벤트 수집
  • 에이전틱 워크플로우의 컴플라이언스 및 감사 가능성
  • 디버깅을 위한 감사 추적 및 재생 메커니즘 설계

성능 튜닝 및 리소스 최적화

  • 추론 오버헤드 감소 및 에이전트 오케스트레이션 사이클 최적화
  • 빠른 검색을 위한 모델 캐싱 및 경량 임베딩
  • AI 파이프라인을 위한 로드 테스트 및 스트레스 시나리오

비용 통제 및 거버넌스

  • 에이전트 비용 요인 이해: API 호출, 메모리, 컴퓨트, 외부 통합
  • 에이전트 수준 비용 추적 및 차지백 모델 구현
  • 에이전트 증식 및 유휴 리소스 소모를 방지하는 자동화 정책

에이전트를 위한 CI/CD 및 롤아웃 전략

  • 에이전트 파이프라인의 CI/CD 시스템 통합
  • 반복적 에이전트 업데이트를 위한 테스트, 버전 관리, 롤백 전략
  • 점진적 롤아웃 및 안전한 배포 메커니즘

장애 복구 및 신뢰성 엔지니어링

  • 결함 허용 및 적절한 성능 저하를 위한 설계
  • 에이전트 신뢰성을 위한 재시도, 타임아웃, 회로 차단기 패턴
  • AI 운영을 위한 인시던트 대응 및 사후 분석(포스트모템) 프레임워크

캡스톤 프로젝트

  • 완전한 모니터링 및 비용 추적을 갖춘 에이전틱 AI 시스템 구축 및 배포
  • 로드 시뮬레이션, 성능 측정, 리소스 사용량 최적화
  • 최종 아키텍처 및 모니터링 대시보드를 동료에게 발표

요약 및 다음 단계

요건

  • MLOps 및 프로덕션 머신러닝 시스템에 대한 깊은 이해
  • 컨테이너 기반 배포(Docker/Kubernetes) 경험
  • 클라우드 비용 최적화 및 관찰 가능성 도구에 대한 친숙함

대상 독자

  • MLOps 엔지니어
  • 사이트 릴리아빌리티 엔지니어 (SREs)
  • AI 인프라를 총괄하는 엔지니어링 매니저
 21 시간

참가자 수


참가자별 가격

회원 평가 (3)

예정된 코스

관련 카테고리