Maskování citlivých osobních údajů
Máš k dispozici datovou sadu obsahující čísla sociálního pojištění (SSN) amerických občanů spolu s jejich městem bydliště a věkem. Pokud by šlo o nezveřejněná data, ke jejichž sdílení jsme nedostali souhlas, jejich zpřístupnění by představovalo narušení soukromí – zveřejnili bychom totiž údaje, se kterými dotyční nepočítali.
Tvým úkolem bude data anonymizovat pomocí částečného maskování citlivého osobního údaje ssn. Nezapomeň: maskování dat znamená skrytí nebo zamlžení informací, aby nedošlo k narušení soukromí – přičemž se zachovává celkový formát i význam dat.
Dataset je načtený jako insurance_df, výsledek ale ulož do masked_df, aby původní insurance_df zůstal beze změny.
Toto cvičení je součástí kurzu
Ochrana soukromí a anonymizace dat v Pythonu
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Uniformly mask the SSN numbers with *
____
# See resulting DataFrame
print(____)