1. Learn
  2. /
  3. Курси
  4. /
  5. Імпорт і керування фінансовими даними в Python

Connected

Вправа

Виділення значень у розподілі

Іноді, щоб побудувати кращу візуалізацію, дані потрібно підготувати. Два методи для опрацювання пропусків — це .dropna() і .fillna(). Ви також можете прибрати викиди, відфільтрувавши значення вище або нижче певного процентиля, застосувавши умову з .quantile() до потрібного стовпця.

У відео ви також бачили, як підкреслити конкретне значення на графіку, додавши вертикальну лінію в позиції x через усі осі:

Axes.axvline(x=0, color=None, ...)

У цій вправі ви востаннє поглянете на глобальний розподіл доходів, приберете викиди вище 95-го процентиля, побудуєте розподіл і виділите як середнє, так і медіану. pandas як pd, seaborn як sns та matplotlib.pyplot як plt уже імпортовано, а датафрейм income з попередніх вправ доступний у вашому робочому середовищі.

Інструкції

100 XP
  • Присвойте стовпець 'Income per Capita' змінній inc_per_capita.
  • Відфільтруйте, щоб лишити лише рядки в inc_per_capita, які нижчі за 95-й процентиль. Переприсвойте до тієї ж змінної.
  • Побудуйте типовий гістограм для відфільтрованої версії inc_per_capita і присвойте його змінній ax.
  • Використайте ax.axvline() з color='b', щоб виділити середнє значення inc_per_capita синім,
  • Використайте ax.axvline() з color='g', щоб виділити медіану зеленим. Покажіть результат!