グループ別の要約統計量
前の演習を踏まえて、この演習では group_by() 関数と組み合わせて dplyr::summarise() および summarise(across(everything(), list())) の構文を使い、sex や adult のような関心のあるカテゴリごとの特定の変数について、カスタム統計量を計算します。
abaloneKeep データセットと dplyr パッケージはすでに読み込まれています。
この演習はコースの一部です
SAS ユーザーのための R
演習の手順
summarise()とgroup_by()を使って、グループ化変数ごとの統計量を計算します。- whole weight について、adult ごとに中央値、第25・第75パーセンタイルを求め、出力名をそれぞれ
median_wweight、q1_wweight、q3_wweightとします。 - height と diameter について、sex ごとに平均と標準偏差を求めます。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Get median, 25th, 75th percentiles for wholeWeight by adult
abaloneKeep %>%
group_by(___) %>%
select(___) %>%
summarise(median_wweight = median(___),
q1_wweight = quantile(___, probs = ___),
q3_wweight = quantile(___, probs = ___))
# Get mean and sd for height and diameter by sex
abaloneKeep %>%
group_by(___) %>%
select(___) %>%
summarise(across(everything(),list(___ = ~ mean(.x),
___ = ~ sd(.x))))