Popularitatea produselor vândute pe state
Setul de date despre piețele fermierilor conține coloane corespunzătoare celor 28 de produse diferite și informații despre dacă acestea sunt sau nu vândute la fiecare piață. Ești curios/curioasă să afli dacă există povești interesante în acest set de date legate de cât de probabil este să găsești un anumit produs la piețele dintr-un stat. Pentru a răspunde la această întrebare, restrângi datele la trei coloane:
state– numele statuluigood– produsul de interesprop_selling– proporția piețelor din acel stat care vând acel produs
Pentru a identifica rapid tiparele care apar, alegi un subset de produse care îți par interesante și decizi să creezi un text-scatter simplu: produsul pe axa x și proporția piețelor dintr-un stat care îl vând pe axa y.
Acest exercițiu face parte din cursul
Îmbunătățirea vizualizărilor de date în Python
Instrucțiuni pentru exercițiu
Filtrează
goods_by_statela produsele dorite, listate înto_plot.Ascunde punctele din diagrama de dispersie setând dimensiunea lor la zero.
- Reține că în
sns.scatterplot(),sizeeste folosit pentru a mapa valorile dintr-o coloană la o scară de dimensiuni, iarseste folosit pentru a seta o dimensiune constantă pentru toate punctele.
- Reține că în
Aliniază textul la centru, astfel încât să se suprapună exact pe poziția x a produsului.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Subset goods to interesting ones
to_plot = ['Cheese','Maple','Fruits','Grains','Seafood','Plants','Vegetables']
goods_by_state_small = goods_by_state.____("good in "+str(to_plot))
g = sns.scatterplot('good','prop_selling', data = goods_by_state_small,
# Hide scatter points by shrinking to nothing
____ = ____)
for _,row in goods_by_state_small.iterrows():
g.annotate(row['state'], (row['good'], row['prop_selling']),
# Center annotation on axis
ha = '____',
size = 10)
plt.show()