ПочатиПочніть безкоштовно

Узагальнення до інтервалів

Модель k-анонімності добре підходить для наборів даних із невеликою кількістю вимірів. Два основні методи анонімізації, що застосовуються для перетворення набору даних на k-анонімну таблицю, — це узагальнення та пригнічення.

У цій вправі ви перетворите набір даних з оцінками задоволеності на 3-анонімну таблицю, що містить потенційно чутливі атрибути, як-от satisfaction_rate і work_hours. Деякі комбінації трапляються менше ніж тричі. Усуньте це, щоб зробити датафрейм 3-анонімним.

Датафрейм доступний як employees. Значення k дорівнює 3 і також доступне.

Ця вправа є частиною курсу

Конфіденційність даних і анонімізація в Python

Переглянути курс

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Calculate how many unique combinations are for BirthYear and Department
print(employees.groupby(['birth_year','department']).____)
Редагувати та запускати код