Kom igångKom igång gratis

Ange booleska kolumner

Datamängder kan innehålla kolumner som lämpar sig bäst att modelleras som booleska värden. Däremot läser pandas vanligtvis in sådana kolumner som flyttal som standard, eftersom en automatisk konvertering till booleska värden kan ge oönskade effekter – till exempel att NA-värden omvandlas till True.

fcc_survey_subset.xlsx innehåller en sträng-ID-kolumn och flera Sant/Falskt-kolumner som indikerar ekonomiska stressfaktorer. Du ska undersöka vilka kolumner utanför ID-kolumnen som saknar NA-värden och därmed kan anges som booleska, och sedan instruera read_excel() att läsa in dem som sådana med argumentet dtype.

pandas är inläst som pd.

Den här övningen är en del av kursen

Effektiv datainläsning med pandas

Visa kurs

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Load the data
survey_data = pd.read_excel("fcc_survey_subset.xlsx")

# Count NA values in each column
print(survey_data.____)
Redigera och kör kod