Začněte nyníZačněte zdarma

Maskování citlivých osobních údajů

Máš k dispozici datovou sadu obsahující čísla sociálního pojištění (SSN) amerických občanů spolu s jejich městem bydliště a věkem. Pokud by šlo o nezveřejněná data, ke jejichž sdílení jsme nedostali souhlas, jejich zpřístupnění by představovalo narušení soukromí – zveřejnili bychom totiž údaje, se kterými dotyční nepočítali.

Tvým úkolem bude data anonymizovat pomocí částečného maskování citlivého osobního údaje ssn. Nezapomeň: maskování dat znamená skrytí nebo zamlžení informací, aby nedošlo k narušení soukromí – přičemž se zachovává celkový formát i význam dat.

Dataset je načtený jako insurance_df, výsledek ale ulož do masked_df, aby původní insurance_df zůstal beze změny.

Toto cvičení je součástí kurzu

Ochrana soukromí a anonymizace dat v Pythonu

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Uniformly mask the SSN numbers with *
____

# See resulting DataFrame
print(____)
Upravit a spustit kód