Популярність товарів за штатами
Набір даних farmer's market містить стовпці для 28 різних товарів і позначки, чи продаються вони на конкретному ринку. Вам цікаво, чи приховує цей набір даних цікаві історії про те, наскільки ймовірно знайти певний товар на ринках того чи іншого штату. Щоб відповісти на це запитання, ви згортаєте дані до трьох стовпців:
state— назва штатуgood— потрібний товарprop_selling— частка ринків у цьому штаті, де продають саме цей товар
Щоб швидко побачити, чи є помітні закономірності, ви обираєте підмножину цікавих товарів і вирішуєте побудувати простий текстово-розсіювальний графік: товар на осі x і частка ринків штату, що продають цей товар, на осі y.
Ця вправа є частиною курсу
Удосконалення візуалізацій даних у Python
Інструкції до вправи
Відфільтруйте
goods_by_stateдо потрібних товарів, перелічених уto_plot.Приховайте точки діаграми розсіювання, встановивши їхній розмір як відсутній.
- Зверніть увагу, що в
sns.scatterplot()sizeвикористовують для відображення значень зі стовпця у шкалу розмірів, аs— щоб задати сталий розмір для всіх точок.
- Зверніть увагу, що в
Зробіть текст вирівняним по центру, щоб він розташовувався безпосередньо в позиції товару на осі x.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Subset goods to interesting ones
to_plot = ['Cheese','Maple','Fruits','Grains','Seafood','Plants','Vegetables']
goods_by_state_small = goods_by_state.____("good in "+str(to_plot))
g = sns.scatterplot('good','prop_selling', data = goods_by_state_small,
# Hide scatter points by shrinking to nothing
____ = ____)
for _,row in goods_by_state_small.iterrows():
g.annotate(row['state'], (row['good'], row['prop_selling']),
# Center annotation on axis
ha = '____',
size = 10)
plt.show()