Aan de slagBegin gratis

Moeders hulpje (2)

Een algemenere manier om kolommen te matchen is controleren of hun namen ergens die waarde bevatten (in plaats van te beginnen of te eindigen met een waarde). Zoals je misschien al raadt, kun je dit doen met een helper genaamd contains().

Nog algemener kun je kolommen matchen met reguliere expressies. Reguliere expressies (kortweg "regexes") zijn een krachtige taal om tekst te matchen. Wil je leren hoe je reguliere expressies gebruikt? Volg dan de cursus *String Manipulation with stringr in R *. Voor nu hoef je maar drie dingen te weten.

  1. a: Een letter betekent: "match die letter".
  2. .: Een punt betekent: "match elk teken, inclusief letters, cijfers, leestekens, enz.".
  3. ?: Een vraagteken betekent: "het vorige teken is optioneel".

Je kunt kolommen vinden die overeenkomen met een bepaalde regex met de matches() select-helper.

Deze oefening maakt deel uit van de cursus

Introductie tot Spark met sparklyr in R

Bekijk cursus

Oefeninstructies

Er is een Spark-verbinding voor je aangemaakt als spark_conn. Een tibble die verwijst naar de trackmetadata die in Spark is opgeslagen, is al gedefinieerd als track_metadata_tbl.

  • Selecteer alle kolommen uit track_metadata_tbl die "ti" bevatten.
  • Selecteer alle kolommen uit track_metadata_tbl die overeenkomen met de reguliere expressie "ti.?t".

Interactieve oefening met praktijkervaring

Probeer deze oefening door deze voorbeeldcode aan te vullen.

# track_metadata_tbl has been pre-defined
track_metadata_tbl

track_metadata_tbl %>%
  # Select columns containing ti
  ___

track_metadata_tbl %>%
  # Select columns matching ti.?t
  ___
Code bewerken en uitvoeren