K-анонімізація набору даних
У цій вправі ви анонімізуєте набір даних NBA Salaries. Пам'ятайте: щоб застосувати k-анонімність, потрібно вказати типи атрибутів. Це можуть бути ідентифікувальні, квазіідентифікувальні, чутливі або нечутливі. Ми зосередимося на age і nba_origin як на квазіідентифікувальних атрибутах, а salary вважатимемо чутливими даними.
Дослідіть nba. Якщо ви знаєте про гравця, наприклад, що він/вона з Іспанії та має 23 роки, то зможете дізнатися чутливу інформацію — його/її зарплату! Тут ми використаємо значення K, рівне 3, щоб гарантувати, що обрані атрибути не можна відрізнити щонайменше від k-1 інших рядків.
Словник ієрархій для nba_Origin уже створено як origin_hierarchy.
Ця вправа є частиною курсу
Конфіденційність даних і анонімізація в Python
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Print how many unique combinations are for age and nba_origin
print(____)