BaşlayınÜcretsiz başlayın

Mutant grupları

Gruplara göre özet istatistikler hesaplamanın yanı sıra, gruba özgü değerlerle sütunları da dönüştürebilirsin. Örneğin, değerleri normalize etmenin bir yolu, ortalamayı çıkarmak ve sonra standart sapmaya bölmektir. Aşağıdaki kodla gruba özgü normalizasyon yapabilirsin.

a_tibble %>%
  group_by(grp1, grp2) %>%
  mutate(normalized_x = (x - mean(x)) / sd(x))

Bu egzersiz, kursun bir parçasıdır

R ile sparklyr kullanarak Spark’a Giriş

Kursa Göz Atın

Egzersiz talimatları

Senin için spark_conn adıyla bir Spark bağlantısı oluşturuldu. Spark'ta depolanan parça metaverisine bağlı bir tibble, track_metadata_tbl olarak önceden tanımlandı.

  • track_metadata içeriğini artist_namee göre grupla.
  • time_since_first_release adlı yeni bir sütun ekle.
    • Bunu, sanatçının bir parça yayımladığı ilk year (yani min() yeari) değerinden, grup bazında year çıkarımına eşitle.
  • Satırları time_since_first_release değerine göre azalan sırada sırala.

Uygulamalı etkileşimli egzersiz

Bu egzersizi bu örnek kodu tamamlayarak deneyin.

# track_metadata_tbl has been pre-defined
track_metadata_tbl

track_metadata_tbl %>%
  # Group by artist
  ___ %>%
  # Calc time since first release
  ___ %>%
  # Arrange by descending time since first release
  ___
Kodu Düzenle ve Çalıştır