Generalisering till intervall
K-anonymitet kan vara en bra integritetsmodell för specifika datamängder som inte har många dimensioner. De två huvudsakliga anonymiseringstekniker som används för att omvandla en datamängd till en k-anonym tabell är generalisering och undertryckning.
I den här övningen omvandlar du en datamängd med nöjdhetsbetyg till en 3-anonym tabell som innehåller möjliga känsliga attribut som satisfaction_rate och work_hours. Vissa kombinationer förekommer färre än tre gånger. Åtgärda det för att göra DataFrame:n 3-anonym.
DataFrame:n finns tillgänglig som employees. Ett k-värde på 3 finns också tillgängligt.
Den här övningen är en del av kursen
Dataintegritet och anonymisering i Python
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Calculate how many unique combinations are for BirthYear and Department
print(employees.groupby(['birth_year','department']).____)