Узагальнення до інтервалів
Модель k-анонімності добре підходить для наборів даних із невеликою кількістю вимірів. Два основні методи анонімізації, що застосовуються для перетворення набору даних на k-анонімну таблицю, — це узагальнення та пригнічення.
У цій вправі ви перетворите набір даних з оцінками задоволеності на 3-анонімну таблицю, що містить потенційно чутливі атрибути, як-от satisfaction_rate і work_hours. Деякі комбінації трапляються менше ніж тричі. Усуньте це, щоб зробити датафрейм 3-анонімним.
Датафрейм доступний як employees. Значення k дорівнює 3 і також доступне.
Ця вправа є частиною курсу
Конфіденційність даних і анонімізація в Python
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Calculate how many unique combinations are for BirthYear and Department
print(employees.groupby(['birth_year','department']).____)