观察分类变量
请回忆上一题中的要点:
- 有序(Ordinal)变量有两个或以上类别,且这些类别可以排序或有先后顺序。
- 无序(Nominal)变量有两个或以上类别,但这些类别没有内在顺序。
在本数据集中:
salary是一个有序变量。department是一个无序变量。
本练习将观察上一题找到的这些分类变量。为此,您将先导入 pandas 库并读取名为 "turnover.csv" 的 CSV 文件。然后,打印这些变量的唯一取值。
本练习是课程的一部分
HR Analytics:用 Python 预测员工流失
练习说明
- 导入
pandas(命名为pd)以读取数据(此步骤已为您完成)。 - 读取
"turnover.csv"文件,并将其保存为名为data的 DataFrame。 - 打印
"department"列的唯一取值。 - 打印
"salary"列的唯一取值。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Import pandas (as pd) to read the data
import pandas as pd
# Read "turnover.csv" file and save it in a DataFrame called data
data = pd.read_csv(____)
# Print the unique values of the "department" column
print(data.____.____())
# Print the unique values of the "salary" column
print(data.____.____())