Ustawianie kolumn logicznych
Zbiory danych mogą zawierać kolumny, które najlepiej reprezentować jako wartości logiczne. Domyślnie pandas wczytuje je jednak jako liczby zmiennoprzecinkowe – automatyczne stosowanie typu Boolean mogłoby powodować niepożądane efekty, np. przekształcanie wartości NA w True.
Plik fcc_survey_subset.xlsx zawiera kolumnę z identyfikatorami tekstowymi oraz kilka kolumn Prawda/Fałsz opisujących czynniki stresu finansowego. Sprawdzisz, które kolumny (poza kolumną ID) nie zawierają wartości NA i można je ustawić jako logiczne, a następnie przekażesz to informację funkcji read_excel() za pomocą argumentu dtype.
Biblioteka pandas jest załadowana jako pd.
To ćwiczenie jest częścią kursu
Sprawne importowanie danych z pandas
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Load the data
survey_data = pd.read_excel("fcc_survey_subset.xlsx")
# Count NA values in each column
print(survey_data.____)