Категория
В Pandas есть тип данных category, который аналогичен фактору в R.
Чтобы преобразовать столбец в категориальный тип данных, передайте 'category' методу .astype().
После этого можно просмотреть все категории (в R они называются уровнями) с помощью аксессора .cat и атрибута .categories.
Категориальные значения также удобны, когда нужно сохранить порядок данных.
Например, логично, что значение «low» должно стоять перед «high». Для задания порядка в столбце используйте reorder_categories().
# Reorder categorical levels
df['column_name'].cat.reorder_categories(['low', 'high'], ordered=True)
Это упражнение является частью курса
Python для пользователей R
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Convert the type of time column
tips['time'] = ____
# Use the cat accessor to print the categories in the time column
print(____)