Kom igångKom igång gratis

Hjälpfunktioner för kolumnval (2)

Ett mer generellt sätt att matcha kolumner är att kontrollera om deras namn innehåller ett visst värde var som helst i strängen – inte bara i början eller slutet. Som du kanske kan gissa gör du detta med hjälpfunktionen contains().

Ännu mer generellt kan du matcha kolumner med hjälp av reguljära uttryck. Reguljära uttryck (ofta kallade "regex") är ett kraftfullt verktyg för att matcha text. Om du vill lära dig mer om reguljära uttryck kan du ta kursen String Manipulation with stringr in R. För nu räcker det att känna till tre saker.

  1. a: En bokstav betyder "matcha den bokstaven".
  2. .: En punkt betyder "matcha vilket tecken som helst – bokstäver, siffror, skiljetecken osv.".
  3. ?: Ett frågetecken betyder "föregående tecken är valfritt".

Du kan hitta kolumner som matchar ett visst regex med hjälpfunktionen matches() i select().

Den här övningen är en del av kursen

Introduktion till Spark med sparklyr i R

Visa kurs

Övningsinstruktioner

En Spark-anslutning har skapats åt dig som spark_conn. En tibble kopplad till spårmetadata lagrad i Spark är fördefinierad som track_metadata_tbl.

  • Välj alla kolumner från track_metadata_tbl som innehåller "ti".
  • Välj alla kolumner från track_metadata_tbl som matchar det reguljära uttrycket "ti.?t".

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# track_metadata_tbl has been pre-defined
track_metadata_tbl

track_metadata_tbl %>%
  # Select columns containing ti
  ___

track_metadata_tbl %>%
  # Select columns matching ti.?t
  ___
Redigera och kör kod