K-анонимизация набора данных
В этом упражнении вы будете анонимизировать набор данных NBA Salaries. Помните, что для применения k-анонимности необходимо указать типы атрибутов: идентифицирующие, квазиидентифицирующие, чувствительные или нечувствительные. Мы будем рассматривать age и nba_origin как квазиидентифицирующие атрибуты, а salary — как чувствительные данные.
Изучите набор данных nba. Если вы знаете, что игрок из Испании и ему 23 года, вы сможете узнать его зарплату! Мы используем значение K равное 3: это гарантирует, что выбранные атрибуты нельзя отличить как минимум от k-1 других строк.
Словарь иерархии для nba_Origin уже создан как origin_hierarchy.
Это упражнение является частью курса
Конфиденциальность данных и анонимизация в Python
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Print how many unique combinations are for age and nba_origin
print(____)