Kom igångKom igång gratis

Generalisering till intervall

K-anonymitet kan vara en bra integritetsmodell för specifika datamängder som inte har många dimensioner. De två huvudsakliga anonymiseringstekniker som används för att omvandla en datamängd till en k-anonym tabell är generalisering och undertryckning.

I den här övningen omvandlar du en datamängd med nöjdhetsbetyg till en 3-anonym tabell som innehåller möjliga känsliga attribut som satisfaction_rate och work_hours. Vissa kombinationer förekommer färre än tre gånger. Åtgärda det för att göra DataFrame:n 3-anonym.

DataFrame:n finns tillgänglig som employees. Ett k-värde på 3 finns också tillgängligt.

Den här övningen är en del av kursen

Dataintegritet och anonymisering i Python

Visa kurs

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Calculate how many unique combinations are for BirthYear and Department
print(employees.groupby(['birth_year','department']).____)
Redigera och kör kod