Zacznij terazZacznij za darmo

Ustawianie kolumn logicznych

Zbiory danych mogą zawierać kolumny, które najlepiej reprezentować jako wartości logiczne. Domyślnie pandas wczytuje je jednak jako liczby zmiennoprzecinkowe – automatyczne stosowanie typu Boolean mogłoby powodować niepożądane efekty, np. przekształcanie wartości NA w True.

Plik fcc_survey_subset.xlsx zawiera kolumnę z identyfikatorami tekstowymi oraz kilka kolumn Prawda/Fałsz opisujących czynniki stresu finansowego. Sprawdzisz, które kolumny (poza kolumną ID) nie zawierają wartości NA i można je ustawić jako logiczne, a następnie przekażesz to informację funkcji read_excel() za pomocą argumentu dtype.

Biblioteka pandas jest załadowana jako pd.

To ćwiczenie jest częścią kursu

Sprawne importowanie danych z pandas

Zobacz kurs

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Load the data
survey_data = pd.read_excel("fcc_survey_subset.xlsx")

# Count NA values in each column
print(survey_data.____)
Edytuj i uruchom kod