Začněte nyníZačněte zdarma

Odstranění titulů a práce se jmény

Při shromažďování metadat o respondentech průzkumu do DataFrame airlines bylo celé jméno každého respondenta uloženo do sloupce full_name. Po bližším prozkoumání jsi ale zjistil/a, že mnohá jména jsou uvozena oslovením, jako například "Dr.", "Mr.", "Ms." nebo "Miss".

Tvým cílem je vytvořit dva nové sloupce first_name a last_name, které budou obsahovat křestní jméno a příjmení respondentů. Nejdříve ale musíš tato oslovení odstranit.

DataFrame airlines je dostupný v tvém prostředí, spolu s knihovnou pandas jako pd.

Toto cvičení je součástí kurzu

Čištění dat v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Odstraň z full_name hodnoty "Dr.", "Mr.", "Miss" a "Ms." tak, že je v daném pořadí nahradíš prázdným řetězcem "".
  • Spusť příkaz assert s použitím .str.contains(), který otestuje, zda full_name stále obsahuje některé z těchto oslovení.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Replace "Dr." with empty string ""
airlines['full_name'] = airlines['full_name'].____.____("____","")

# Replace "Mr." with empty string ""
airlines['full_name'] = ____

# Replace "Miss" with empty string ""
____

# Replace "Ms." with empty string ""
____

# Assert that full_name has no honorifics
assert airlines['full_name'].str.contains('Ms.|Mr.|Miss|Dr.').any() == False
Upravit a spustit kód