Začněte nyníZačněte zdarma

Řazení řádků

V dobách, kdy se hudba ukládala na CD, byl jeden věčný problém: jak nejlépe seřadit CD, abys vždy rychle našel/a to, co hledáš? Podle interpreta? Chronologicky? Podle žánru?

Funkce arrange() ti umožňuje přeuspořádat řádky tibble. Jako argumenty přijímá tibble a za ním neuzavřené názvy sloupců. Pokud chceš například seřadit řádky vzestupně podle hodnot sloupce x a při shodě pak sestupně podle hodnot y, napíšeš:

a_tibble %>%
  arrange(x, desc(y))

Všimni si použití funkce desc() pro sestupné řazení. Také pamatuj, že v sparklyr funkce order(), která slouží k řazení řádků data.frameů, nefunguje.

Toto cvičení je součástí kurzu

Úvod do Sparku se sparklyr v R

Zobrazit kurz

Pokyny k cvičení

Spark připojení je pro tebe připraveno jako spark_conn. Tibble napojený na metadata skladeb uložená ve Sparku je předdefinován jako track_metadata_tbl.

  • Vyber pole artist_name, release, title a year.
  • Výsledek přepošli rourou do filter() a filtruj skladby z 60. let.
  • Výsledek přepošli rourou do arrange() a seřaď záznamy podle artist_name, pak sestupně podle year a nakonec podle title.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# track_metadata_tbl has been pre-defined
track_metadata_tbl

# Manipulate the track metadata
track_metadata_tbl %>%
  # Select columns
  ___ %>%
  # Filter rows
  ___ %>%
  # Arrange rows
  ___
Upravit a spustit kód