Začněte nyníZačněte zdarma

Pomocníci při výběru sloupců (2)

Obecnější způsob, jak vybírat sloupce, je zkontrolovat, zda jejich název obsahuje určitou hodnotu kdekoliv uvnitř (ne jen na začátku nebo konci). Jak asi tušíš, slouží k tomu pomocná funkce contains().

Ještě obecnějším přístupem je výběr sloupců pomocí regulárních výrazů. Regulární výrazy (zkráceně „regexy") jsou výkonný jazyk pro porovnávání textu. Pokud se chceš naučit pracovat s regulárními výrazy, mrkni na kurz String Manipulation with stringr in R. Prozatím potřebuješ znát jen tři věci.

  1. a: Písmeno znamená „shoduj se s tímto písmenem".
  2. .: Tečka znamená „shoduj se s libovolným znakem — písmenem, číslem, interpunkcí atd.".
  3. ?: Otazník znamená „předchozí znak je volitelný".

Sloupce odpovídající konkrétnímu regulárnímu výrazu najdeš pomocí select helperu matches().

Toto cvičení je součástí kurzu

Úvod do Sparku se sparklyr v R

Zobrazit kurz

Pokyny k cvičení

Spark připojení je pro tebe připraveno jako spark_conn. Tibble napojený na metadata skladeb uložená ve Sparku je předdefinován jako track_metadata_tbl.

  • Vyber všechny sloupce z track_metadata_tbl, které obsahují "ti".
  • Vyber všechny sloupce z track_metadata_tbl, které odpovídají regulárnímu výrazu "ti.?t".

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# track_metadata_tbl has been pre-defined
track_metadata_tbl

track_metadata_tbl %>%
  # Select columns containing ti
  ___

track_metadata_tbl %>%
  # Select columns matching ti.?t
  ___
Upravit a spustit kód