Jednoduché vzorkování s dplyr
V průběhu této kapitoly budeš pracovat s daty o skladbách ze Spotify. Každý řádek datasetu představuje jednu skladbu a celkem jich je 41 656. Sloupce obsahují název skladby, interprety, rok vydání a různé vlastnosti jako délku, tempo nebo tanečnost. Začneme délkami skladeb.
Tvým prvním úkolem je vzorkovat dataset skladeb a porovnat výpočet na celé populaci se stejným výpočtem na vzorku.
Dataset spotify_population je k dispozici a balíček dplyr je načtený.
Toto cvičení je součástí kurzu
Vzorkování v R
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# View the whole population dataset
___
# Sample 1000 rows from spotify_population
spotify_sample <- ___
# See the result
spotify_sample