dplyr로 단순 추출하기
이번 장 전반에 걸쳐 Spotify의 노래 데이터를 탐색할 거예요. 데이터셋의 각 행은 노래 하나를 나타내며, 총 41656행이 있습니다. 열에는 노래 제목, 참여 아티스트, 발매 연도, 그리고 재생 시간, 템포, danceability 같은 노래 속성이 포함되어 있어요. 먼저 재생 시간부터 살펴보겠습니다.
첫 번째 과제는 노래 데이터셋에서 표본을 추출하고, 모집단 전체와 표본에서의 계산 결과를 비교하는 것입니다.
spotify_population은 준비되어 있고 dplyr도 로드되어 있습니다.
이 연습은 강의의 일부입니다
R에서의 표본추출
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# View the whole population dataset
___
# Sample 1000 rows from spotify_population
spotify_sample <- ___
# See the result
spotify_sample