始める無料で始める

マスターデータの概要

ここまでで、元のデータセットに ratingsurvey の情報を結合しました。

さらに、compensationno_leaves_taken(取得した休暇日数)、hiring_source などの従業員関連情報を追加したデータセット org_final を用意しています。次の章で特徴量エンジニアリングに進む前に、このデータセットを確認しておきましょう。

この演習はコースの一部です

HRアナリティクス:Rで社員離職を予測する

コースを見る

演習の手順

  • glimpse() を使って、org_final データセットの構造を確認します。
  • org_final データセットの変数数を variables に代入します。
  • ActiveInactive の従業員それぞれについて、distance_from_home の分布を可視化する箱ひげ図を作成します。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# View the structure of the dataset
___

# Number of variables in the dataset
variables <- ___

# Compare the travel distance of Active and Inactive employees
ggplot(org_final, aes(x = ___, y = ___)) +
  ___
コードを編集して実行