Obserwowanie zmiennych kategorycznych
Pamiętaj z poprzedniego ćwiczenia, że:
- Zmienne porządkowe mają dwie lub więcej kategorii, które można uszeregować lub posortować
- Zmienne nominalne mają dwie lub więcej kategorii, które nie mają wewnętrznego porządku
W twoim zbiorze danych:
salaryjest zmienną porządkowądepartmentjest zmienną nominalną
W tym ćwiczeniu przyjrzysz się zmiennym kategorycznym znalezionym w poprzednim ćwiczeniu. W tym celu najpierw zaimportujesz bibliotekę pandas i wczytasz plik CSV o nazwie "turnover.csv". Następnie wyświetlisz unikalne wartości tych zmiennych.
To ćwiczenie jest częścią kursu
HR Analytics: Przewidywanie rotacji pracowników w Pythonie
Instrukcje do ćwiczenia
- Zaimportuj
pandas(jakopd), aby wczytać dane (to już zostało za ciebie zrobione). - Wczytaj plik
"turnover.csv"i zapisz go w ramce danych o nazwiedata. - Wyświetl unikalne wartości kolumny
"department". - Wyświetl unikalne wartości kolumny
"salary".
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Import pandas (as pd) to read the data
import pandas as pd
# Read "turnover.csv" file and save it in a DataFrame called data
data = pd.read_csv(____)
# Print the unique values of the "department" column
print(data.____.____())
# Print the unique values of the "salary" column
print(data.____.____())