始める無料で始める

グループ別の要約統計量

前の演習を踏まえて、この演習では group_by() 関数と組み合わせて dplyr::summarise() および summarise(across(everything(), list())) の構文を使い、sexadult のような関心のあるカテゴリごとの特定の変数について、カスタム統計量を計算します。

abaloneKeep データセットと dplyr パッケージはすでに読み込まれています。

この演習はコースの一部です

SAS ユーザーのための R

コースを見る

演習の手順

  • summarise()group_by() を使って、グループ化変数ごとの統計量を計算します。
  • whole weight について、adult ごとに中央値、第25・第75パーセンタイルを求め、出力名をそれぞれ median_wweightq1_wweightq3_wweight とします。
  • height と diameter について、sex ごとに平均と標準偏差を求めます。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Get median, 25th, 75th percentiles for wholeWeight by adult
abaloneKeep %>% 
  group_by(___) %>%
  select(___) %>%
  summarise(median_wweight = median(___),
            q1_wweight = quantile(___, probs = ___),
            q3_wweight = quantile(___, probs = ___))

# Get mean and sd for height and diameter by sex
abaloneKeep %>%
  group_by(___) %>%
  select(___) %>%
  summarise(across(everything(),list(___ = ~ mean(.x),
                                     ___ = ~ sd(.x))))
コードを編集して実行