Odstranění titulů a práce se jmény
Při shromažďování metadat o respondentech průzkumu do DataFrame airlines bylo celé jméno každého respondenta uloženo do sloupce full_name. Po bližším prozkoumání jsi ale zjistil/a, že mnohá jména jsou uvozena oslovením, jako například "Dr.", "Mr.", "Ms." nebo "Miss".
Tvým cílem je vytvořit dva nové sloupce first_name a last_name, které budou obsahovat křestní jméno a příjmení respondentů. Nejdříve ale musíš tato oslovení odstranit.
DataFrame airlines je dostupný v tvém prostředí, spolu s knihovnou pandas jako pd.
Toto cvičení je součástí kurzu
Čištění dat v Pythonu
Pokyny k cvičení
- Odstraň z
full_namehodnoty"Dr.","Mr.","Miss"a"Ms."tak, že je v daném pořadí nahradíš prázdným řetězcem"". - Spusť příkaz
asserts použitím.str.contains(), který otestuje, zdafull_namestále obsahuje některé z těchto oslovení.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Replace "Dr." with empty string ""
airlines['full_name'] = airlines['full_name'].____.____("____","")
# Replace "Mr." with empty string ""
airlines['full_name'] = ____
# Replace "Miss" with empty string ""
____
# Replace "Ms." with empty string ""
____
# Assert that full_name has no honorifics
assert airlines['full_name'].str.contains('Ms.|Mr.|Miss|Dr.').any() == False