作業環境には新しいデータセット ds1、ds2、ds3 があり、いずれもカテゴリカルデータの2列を含みます。3つすべてについて、2変数の独立性は置換によるカイ二乗検定で評価できますが、カイ二乗の近似法が正確に適用できるのは1つだけです。どれでしょうか?
ds1
ds2
ds3
注意:これらのデータセットは2列のみなので、元のデータフレームに対して table() を実行するだけで分割表を作成できます。
table()
この演習はコースの一部です
理論を実践に変える、インタラクティブな演習のひとつをお試しください
この章では、カテゴリカルデータを特徴づける単一のパラメータに対して統計的推測を行う方法を学びます。単一の比率に対するリサンプリングに基づく手法と近似に基づく手法の両方を扱います。
この章では、単一パラメータに対して仮説検定を実施し、信頼区間を構築する方法をさらに深く学びます。続いて、2つの比率の差に対して推測を行う方法を学びます。最後に、帰無仮説が正しいとわかっているときに何が起こるのかを探ります。
このパートでは、2つのカテゴリカル変数の独立性を検定するために、リサンプリング法と古典的手法の両方を使う方法を学びます。この章では、カイ二乗検定の実施方法を取り上げます。
現在の演習
コースの締めくくりとして、選挙データを用いた2つのケーススタディを行います。ここでは、カイ二乗検定を使って適合度を確認する方法を学びます。イランとアイオワの選挙結果を題材に、これらのデータセットにベンフォードの法則が当てはまるかを検定します。