НачатьНачать бесплатно

K-анонимизация набора данных

В этом упражнении вы будете анонимизировать набор данных NBA Salaries. Помните, что для применения k-анонимности необходимо указать типы атрибутов: идентифицирующие, квазиидентифицирующие, чувствительные или нечувствительные. Мы будем рассматривать age и nba_origin как квазиидентифицирующие атрибуты, а salary — как чувствительные данные.

Изучите набор данных nba. Если вы знаете, что игрок из Испании и ему 23 года, вы сможете узнать его зарплату! Мы используем значение K равное 3: это гарантирует, что выбранные атрибуты нельзя отличить как минимум от k-1 других строк.

Словарь иерархии для nba_Origin уже создан как origin_hierarchy.

Это упражнение является частью курса

Конфиденциальность данных и анонимизация в Python

Посмотреть курс

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Print how many unique combinations are for age and nba_origin
print(____)
Редактировать и запускать код