or
이 연습은 강의의 일부입니다
다변량 데이터 입문 챕터에서는 데이터를 읽고 요약하는 방법을 배웁니다. 평균 벡터, 분산-공분산 행렬, 상관 행렬과 같은 기술 통계량을 사용해 다변량 데이터를 요약하는 방법을 학습합니다. 이후 다변량 데이터에 대한 통찰을 제공하는 시각화 기법도 살펴봅니다.
현재 연습
이 챕터에서는 가장 중요하고 널리 사용되는 다변량 확률 분포인 다변량 정규분포를 소개합니다. 다변량 정규분포에서 난수 표본을 생성하고, 이 분포의 밀도와 확률을 계산 및 시각화하는 방법을 배웁니다. 또한 데이터셋이 다변량 정규성을 따르는지 검정하는 방법도 학습합니다.
이 챕터에서는 비정규 데이터를 모델링하기 위한 다양한 확률 분포를 소개합니다. 특히 두꺼운 꼬리를 모델링할 수 있으며 단변량 Student t분포를 일반화한 다변량 t분포를 학습합니다. 또한 오른쪽 또는 왼쪽으로 치우친 데이터를 모델링하도록 설계된 다양한 왜도 분포도 소개합니다.
마지막 챕터에서는 주성분 분석(PCA)과 다차원 척도법(MDS)을 포함한 고차원 데이터 분석 기법을 소개합니다. 실제 데이터를 분석하며 이 기법들을 직접 구현하는 방법도 학습합니다.