Satırları sıralama
Müziğin CD'lerde saklandığı zamanlarda, bitmeyen bir sorun vardı: İstediğin CD'leri kolay bulmak için en iyi sıralama nasıl olmalıydı? Sanatçı adına göre mi? Kronolojik olarak mı? Türüne göre mi?
arrange() fonksiyonu, bir tibble'ın satırlarını yeniden sıralamana izin verir. Bir tibble'ı ve ardından tırnaksız sütun adlarını alır. Örneğin, önce x sütununun değerlerine göre artan, sonra da (eğer x'te eşitlik varsa) y değerlerine göre azalan sıralamak için aşağıdaki gibi yazarsın.
a_tibble %>%
arrange(x, desc(y))
Azalan sırada sıralamayı zorlamak için desc() kullanımına dikkat et. Ayrıca sparklyr içinde, data.frame satırlarını düzenlemek için kullanılan order() fonksiyonunun çalışmadığını da bil.
Bu egzersiz, kursun bir parçasıdır
R ile sparklyr kullanarak Spark’a Giriş
Egzersiz talimatları
Senin için spark_conn adıyla bir Spark bağlantısı oluşturuldu. Spark'ta depolanan parça meta verilerine bağlı bir tibble track_metadata_tbl olarak önceden tanımlandı.
artist_name,release,titleveyearalanlarını seç.- Sonucu 1960'lar dönemindeki parçaları filtrelemek için pipe'la.
- Sonucu
arrange()ile pipe'layarak önceartist_name, sonra azalanyear, sonratitleolacak şekilde sırala.
Uygulamalı etkileşimli egzersiz
Bu egzersizi bu örnek kodu tamamlayarak deneyin.
# track_metadata_tbl has been pre-defined
track_metadata_tbl
# Manipulate the track metadata
track_metadata_tbl %>%
# Select columns
___ %>%
# Filter rows
___ %>%
# Arrange rows
___