CommencezCommencez gratuitement

Trier des lignes

À l'époque où la musique était sur des CD, une question revenait sans cesse : comment les classer pour retrouver rapidement ce que vous cherchez ? Par artiste ? Chronologiquement ? Par genre ?

La fonction arrange() vous permet de réorganiser les lignes d'un tibble. Elle reçoit un tibble, suivi des noms de colonnes non cités. Par exemple, pour trier par ordre croissant selon la colonne x, puis (en cas d'égalité sur x) par ordre décroissant selon y, vous écririez ce qui suit.

a_tibble %>%
  arrange(x, desc(y))

Remarquez l'utilisation de desc() pour imposer un tri décroissant. Notez aussi que dans sparklyr, la fonction order(), utilisée pour ordonner les lignes des data.frame, ne fonctionne pas.

Cette activité fait partie du cours

Introduction à Spark avec sparklyr en R

Voir le cours

Instructions de l’exercice

Une connexion Spark a été créée pour vous sous le nom spark_conn. Un tibble associé aux métadonnées des pistes stockées dans Spark a été prédéfini sous le nom track_metadata_tbl.

  • Sélectionnez les champs artist_name, release, title et year.
  • Transférez le résultat pour filtrer les pistes des années 1960.
  • Transférez ensuite le résultat à arrange() pour trier par artist_name, puis par year en ordre décroissant, puis par title.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# track_metadata_tbl has been pre-defined
track_metadata_tbl

# Manipulate the track metadata
track_metadata_tbl %>%
  # Select columns
  ___ %>%
  # Filter rows
  ___ %>%
  # Arrange rows
  ___
Modifier et exécuter le code