データセットを分割する
尺度開発の過程では、同じデータセットを使うとモデル適合度が過大評価される可能性があるため、EFAとCFAは別々のデータセットで行うことが重要です。そこで、データセットを半分に分割し、片方をEFAに、もう片方をCFAに使用します。
この演習はコースの一部です
Rで学ぶ因子分析
演習の手順
- どの行がどのデータセットに属するかを決める2つのインデックス集合を使って、データセットを半分に分割します。
- 1つ目のインデックス集合でEFA用のデータセットを作成し、2つ目の集合でCFA用のデータセットを作成します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Establish two sets of indices to split the dataset
N <- nrow(gcbs)
indices <- seq(1, ___)
indices_EFA <- sample(indices, floor((.5*___)))
indices_CFA <- indices[!(indices %in% ___)]
# Use those indices to split the dataset into halves for your EFA and CFA
gcbs_EFA <- gcbs[___, ]
gcbs_CFA <- gcbs[___, ]