Riordinare le righe
Quando la musica si ascoltava su CD, c’era un problema ricorrente: come ordinarli al meglio per trovare subito quello che ti serve? Per artista? In ordine cronologico? Per genere?
La funzione arrange() ti permette di riordinare le righe di una tibble. Prende una tibble seguita dai nomi delle colonne non tra apici. Per esempio, per ordinare in ordine crescente i valori della colonna x e poi (in caso di parità in x) in ordine decrescente i valori di y, scriveresti quanto segue.
a_tibble %>%
arrange(x, desc(y))
Nota l’uso di desc() per forzare l’ordinamento in senso decrescente. Tieni anche presente che in sparklyr la funzione order(), usata per riordinare le righe dei data.frame, non funziona.
Questo esercizio fa parte del corso
Introduzione a Spark con sparklyr in R
Istruzioni dell'esercizio
Una connessione Spark è già stata creata come spark_conn. Una tibble collegata ai metadati delle tracce archiviati in Spark è stata predefinita come track_metadata_tbl.
- Seleziona i campi
artist_name,release,titleeyear. - Fai il pipe del risultato per filtrare le tracce degli anni ’60.
- Fai il pipe del risultato in
arrange()per ordinare perartist_name, poiyearin ordine decrescente, poititle.
esercizio interattivo pratico
Prova questo esercizio completando questo codice di esempio.
# track_metadata_tbl has been pre-defined
track_metadata_tbl
# Manipulate the track metadata
track_metadata_tbl %>%
# Select columns
___ %>%
# Filter rows
___ %>%
# Arrange rows
___