BaşlayınÜcretsiz başlayın

Satırları sıralama

Müziğin CD'lerde saklandığı zamanlarda, bitmeyen bir sorun vardı: İstediğin CD'leri kolay bulmak için en iyi sıralama nasıl olmalıydı? Sanatçı adına göre mi? Kronolojik olarak mı? Türüne göre mi?

arrange() fonksiyonu, bir tibble'ın satırlarını yeniden sıralamana izin verir. Bir tibble'ı ve ardından tırnaksız sütun adlarını alır. Örneğin, önce x sütununun değerlerine göre artan, sonra da (eğer x'te eşitlik varsa) y değerlerine göre azalan sıralamak için aşağıdaki gibi yazarsın.

a_tibble %>%
  arrange(x, desc(y))

Azalan sırada sıralamayı zorlamak için desc() kullanımına dikkat et. Ayrıca sparklyr içinde, data.frame satırlarını düzenlemek için kullanılan order() fonksiyonunun çalışmadığını da bil.

Bu egzersiz, kursun bir parçasıdır

R ile sparklyr kullanarak Spark’a Giriş

Kursa Göz Atın

Egzersiz talimatları

Senin için spark_conn adıyla bir Spark bağlantısı oluşturuldu. Spark'ta depolanan parça meta verilerine bağlı bir tibble track_metadata_tbl olarak önceden tanımlandı.

  • artist_name, release, title ve year alanlarını seç.
  • Sonucu 1960'lar dönemindeki parçaları filtrelemek için pipe'la.
  • Sonucu arrange() ile pipe'layarak önce artist_name, sonra azalan year, sonra title olacak şekilde sırala.

Uygulamalı etkileşimli egzersiz

Bu egzersizi bu örnek kodu tamamlayarak deneyin.

# track_metadata_tbl has been pre-defined
track_metadata_tbl

# Manipulate the track metadata
track_metadata_tbl %>%
  # Select columns
  ___ %>%
  # Filter rows
  ___ %>%
  # Arrange rows
  ___
Kodu Düzenle ve Çalıştır