Верхнее и нижнее кодирование зарплат в Белом доме
Верхнее и нижнее кодирование позволяют скрыть выбросы и снизить риск идентификации, не уменьшая полезность данных.
В этом упражнении вы будете работать с данными о зарплатах сотрудников Белого дома США за 2019 и 2020 годы. Примените метод верхнего и нижнего кодирования к столбцу salary.
Сначала вы изучите распределение зарплат и убедитесь, что основная масса значений сосредоточена в центре. На основе этого анализа вы выберете подходящие значения для верхнего и нижнего кодирования.
DataFrame загружен как wh2020.
Это упражнение является частью курса
Конфиденциальность данных и анонимизация в Python
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Plot a histogram of salaries
____
plt.show()