MovieLens 데이터셋 익히기
이제 Market Basket Analysis 도구를 갖췄으니, 학습한 내용을 MovieLens 데이터에 적용해 사용자가 시청한 영화를 바탕으로 추천을 만들어 보겠습니다. 이번 연습에서는 MovieLens 데이터의 일부인 movie_subset 데이터셋에 익숙해지는 것이 목표예요.
먼저 n_distinct() 함수를 사용해 고유한 사용자 ID와 영화 ID의 개수를 추출하고, summarize() 함수를 이용해 사용자별 영화 시청 습관 분포를 시각화해 보겠습니다.
이 연습은 강의의 일부입니다