Pomocníci při výběru sloupců (2)
Obecnější způsob, jak vybírat sloupce, je zkontrolovat, zda jejich název obsahuje určitou hodnotu kdekoliv uvnitř (ne jen na začátku nebo konci). Jak asi tušíš, slouží k tomu pomocná funkce contains().
Ještě obecnějším přístupem je výběr sloupců pomocí regulárních výrazů. Regulární výrazy (zkráceně „regexy") jsou výkonný jazyk pro porovnávání textu. Pokud se chceš naučit pracovat s regulárními výrazy, mrkni na kurz String Manipulation with stringr in R. Prozatím potřebuješ znát jen tři věci.
a: Písmeno znamená „shoduj se s tímto písmenem"..: Tečka znamená „shoduj se s libovolným znakem — písmenem, číslem, interpunkcí atd.".?: Otazník znamená „předchozí znak je volitelný".
Sloupce odpovídající konkrétnímu regulárnímu výrazu najdeš pomocí select helperu matches().
Toto cvičení je součástí kurzu
Úvod do Sparku se sparklyr v R
Pokyny k cvičení
Spark připojení je pro tebe připraveno jako spark_conn. Tibble napojený na metadata skladeb uložená ve Sparku je předdefinován jako track_metadata_tbl.
- Vyber všechny sloupce z
track_metadata_tbl, které obsahují"ti". - Vyber všechny sloupce z
track_metadata_tbl, které odpovídají regulárnímu výrazu"ti.?t".
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# track_metadata_tbl has been pre-defined
track_metadata_tbl
track_metadata_tbl %>%
# Select columns containing ti
___
track_metadata_tbl %>%
# Select columns matching ti.?t
___