开始使用免费开始使用

查找分类变量

分类变量是指只能取有限个取值、用于描述类别的变量。它可以分为两类:

  • 有序型(Ordinal)——具有两个或以上类别,且这些类别可以排序或比较高低(如 "low"、"medium"、"high")
  • 无序型(Nominal)——具有两个或以上类别,但这些类别没有内在顺序(如 "men"、"women")

在本练习中,您将找出数据集中的分类变量。为此,首先导入 pandas 库并读取名为 "turnover.csv" 的 CSV 文件。然后查看前 5 行,直观地注意到 DataFrame 中包含非数值型数据,接着获取数据集中各变量类型的相关信息。

本练习是课程的一部分

HR Analytics:用 Python 预测员工流失

查看课程

练习说明

  • 导入 pandas(命名为 pd)以读取数据。
  • 读取 "turnover.csv" 文件,并将其保存为名为 data 的 DataFrame。
  • 快速查看前 5 行数据。
  • 使用 info() 获取数据中变量类型的信息。

交互式实操练习

通过完成这段示例代码来试试这个练习。

# Import pandas (as pd) to read the data
import ____ as pd

# Read "turnover.csv" and save it in a DataFrame called data
data = pd.____("turnover.csv")

# Take a quick look to the first 5 rows of data
print(data.____())

# Get some information on the types of variables in data
data.____()
编辑并运行代码