ПочатиПочніть безкоштовно

Популярність товарів за штатами

Набір даних farmer's market містить стовпці для 28 різних товарів і позначки, чи продаються вони на конкретному ринку. Вам цікаво, чи приховує цей набір даних цікаві історії про те, наскільки ймовірно знайти певний товар на ринках того чи іншого штату. Щоб відповісти на це запитання, ви згортаєте дані до трьох стовпців:

  • state — назва штату
  • good — потрібний товар
  • prop_selling — частка ринків у цьому штаті, де продають саме цей товар

Щоб швидко побачити, чи є помітні закономірності, ви обираєте підмножину цікавих товарів і вирішуєте побудувати простий текстово-розсіювальний графік: товар на осі x і частка ринків штату, що продають цей товар, на осі y.

Ця вправа є частиною курсу

Удосконалення візуалізацій даних у Python

Переглянути курс

Інструкції до вправи

  • Відфільтруйте goods_by_state до потрібних товарів, перелічених у to_plot.

  • Приховайте точки діаграми розсіювання, встановивши їхній розмір як відсутній.

    • Зверніть увагу, що в sns.scatterplot() size використовують для відображення значень зі стовпця у шкалу розмірів, а s — щоб задати сталий розмір для всіх точок.
  • Зробіть текст вирівняним по центру, щоб він розташовувався безпосередньо в позиції товару на осі x.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Subset goods to interesting ones
to_plot = ['Cheese','Maple','Fruits','Grains','Seafood','Plants','Vegetables']
goods_by_state_small = goods_by_state.____("good in "+str(to_plot))

g = sns.scatterplot('good','prop_selling', data = goods_by_state_small,
                    # Hide scatter points by shrinking to nothing
                    ____ = ____)

for _,row in goods_by_state_small.iterrows():
  g.annotate(row['state'], (row['good'], row['prop_selling']), 
             # Center annotation on axis
             ha = '____', 
             size = 10)

plt.show()
Редагувати та запускати код