Začněte nyníZačněte zdarma

Jednoduché vzorkování s dplyr

V průběhu této kapitoly budeš pracovat s daty o skladbách ze Spotify. Každý řádek datasetu představuje jednu skladbu a celkem jich je 41 656. Sloupce obsahují název skladby, interprety, rok vydání a různé vlastnosti jako délku, tempo nebo tanečnost. Začneme délkami skladeb.

Tvým prvním úkolem je vzorkovat dataset skladeb a porovnat výpočet na celé populaci se stejným výpočtem na vzorku.

Dataset spotify_population je k dispozici a balíček dplyr je načtený.

Toto cvičení je součástí kurzu

Vzorkování v R

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# View the whole population dataset
___

# Sample 1000 rows from spotify_population
spotify_sample <- ___


# See the result
spotify_sample
Upravit a spustit kód