グループの比較
この演習では、データの分布をグループ間で比較します。
datasets パッケージの PlantGrowth データセットには、収量に関する実験結果が含まれています。
このデータセットには次の2変数があります。
group- 結果が対照群か、2つの処置群のどちらかを示します。weight- 乾燥重量(収量の指標として用いる植物の重さ)です。
tapply() はグループごとに指標を計算できることを思い出してください。
たとえば、
tapply(df$x, df$grp, FUN = median)
は、データフレーム df における grp ごとの x の中央値を返します。
あなたのタスクは、収量の weight について平均を計算し、さらに代表的な5つの統計量を可視化することです。グラフで表すことで、応答変数のグループ間の違いを比較しやすくなります。
この演習はコースの一部です
R で学ぶ統計面接対策
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Calculate means across groups
tapply(___, PlantGrowth$group, FUN = ___)
# Graphically compare statistics across groups
___(___ ~ group, data = ___)