ПочатиПочніть безкоштовно

K-анонімізація набору даних

У цій вправі ви анонімізуєте набір даних NBA Salaries. Пам'ятайте: щоб застосувати k-анонімність, потрібно вказати типи атрибутів. Це можуть бути ідентифікувальні, квазіідентифікувальні, чутливі або нечутливі. Ми зосередимося на age і nba_origin як на квазіідентифікувальних атрибутах, а salary вважатимемо чутливими даними.

Дослідіть nba. Якщо ви знаєте про гравця, наприклад, що він/вона з Іспанії та має 23 роки, то зможете дізнатися чутливу інформацію — його/її зарплату! Тут ми використаємо значення K, рівне 3, щоб гарантувати, що обрані атрибути не можна відрізнити щонайменше від k-1 інших рядків.

Словник ієрархій для nba_Origin уже створено як origin_hierarchy.

Ця вправа є частиною курсу

Конфіденційність даних і анонімізація в Python

Переглянути курс

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Print how many unique combinations are for age and nba_origin
print(____)
Редагувати та запускати код