Řazení řádků
V dobách, kdy se hudba ukládala na CD, byl jeden věčný problém: jak nejlépe seřadit CD, abys vždy rychle našel/a to, co hledáš? Podle interpreta? Chronologicky? Podle žánru?
Funkce arrange() ti umožňuje přeuspořádat řádky tibble. Jako argumenty přijímá tibble a za ním neuzavřené názvy sloupců. Pokud chceš například seřadit řádky vzestupně podle hodnot sloupce x a při shodě pak sestupně podle hodnot y, napíšeš:
a_tibble %>%
arrange(x, desc(y))
Všimni si použití funkce desc() pro sestupné řazení. Také pamatuj, že v sparklyr funkce order(), která slouží k řazení řádků data.frameů, nefunguje.
Toto cvičení je součástí kurzu
Úvod do Sparku se sparklyr v R
Pokyny k cvičení
Spark připojení je pro tebe připraveno jako spark_conn. Tibble napojený na metadata skladeb uložená ve Sparku je předdefinován jako track_metadata_tbl.
- Vyber pole
artist_name,release,titleayear. - Výsledek přepošli rourou do
filter()a filtruj skladby z 60. let. - Výsledek přepošli rourou do
arrange()a seřaď záznamy podleartist_name, pak sestupně podleyeara nakonec podletitle.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# track_metadata_tbl has been pre-defined
track_metadata_tbl
# Manipulate the track metadata
track_metadata_tbl %>%
# Select columns
___ %>%
# Filter rows
___ %>%
# Arrange rows
___