行の並び替え
CDで音楽を聴いていた時代には、あの悩ましい問題がありました。CDをどう並べれば、聴きたい1枚をすぐに見つけられるか。アーティスト順? 年代順? ジャンル別?
arrange() 関数を使うと、tibble の行を並び替えることができます。tibble に続けて、引用符なしの列名を渡します。たとえば、列 x の値の昇順で並び替え、x が同じ場合は列 y の値の降順で並び替えるには、次のように書きます。
a_tibble %>%
arrange(x, desc(y))
降順で並び替えるには desc() を使います。なお、sparklyr では、data.frame の行を並び替えるために使う order() 関数は動作しない点に注意してください。
この演習はコースの一部です
sparklyr を使った Spark 入門(R)
演習の手順
Spark への接続は spark_conn として作成済みです。Spark に保存されたトラックのメタデータに紐付けられた tibble は track_metadata_tbl として定義されています。
artist_name、release、title、yearフィールドを選択します。- その結果をパイプで渡し、1960年代のトラックに絞り込みます。
- さらにその結果をパイプで
arrange()に渡し、artist_nameの昇順、次にyearの降順、さらにtitleの順で並び替えます。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# track_metadata_tbl has been pre-defined
track_metadata_tbl
# Manipulate the track metadata
track_metadata_tbl %>%
# Select columns
___ %>%
# Filter rows
___ %>%
# Arrange rows
___