水準数を調べる
データセットを探索するときに役立つ dplyr の関数がほかにも2つあります。1つ目は slice_max(var, n = x) で、var の値に基づいて先頭から x 行を取得します。もう1つは pull() で、列を取り出して列名を外し、列の値だけをベクトルとして取得できます。
たとえば、クラシックな mtcars データセットから mpg の上位2つの値をセットとして取得したい場合は、次のように書きます。
mtcars %>%
slice_max(mpg, n = 2) %>%
pull(mpg)
これにより、次の結果が得られます。
[1] 32.4 33.9
この演習はコースの一部です
tidyverse で学ぶカテゴリ型データ
演習の手順
slice_max()を使って、ファクターの水準数が最も多い上位3行を表示します。- 変数
CurrentJobTitleSelectをフィルタリングし、その水準数をpullで取り出してください。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Select the 3 rows with the highest number of levels
number_of_levels %>%
___(num_levels, n = 3)
number_of_levels %>%
# Filter for where the column called variable equals CurrentJobTitleSelect
filter(___) %>%
# Pull num_levels
___