Vyčištění pozadí
Při zkoumání vzorců prodeje zboží na farmářských trzích na úrovni jednotlivých států tě zaujalo několik z nich. Severní Dakota a Nové Mexiko se pravidelně umisťovaly na konci žebříčku, pokud jde o podíl farmářských trhů prodávajících daný druh zboží. Vermont naopak vždy patřil na přední příčky. Chceš zobrazit celkové vzorce prodeje zboží podle státu a zároveň zvýraznit státy, které tě zaujaly.
Vytvoříš bodový graf, který znázorňuje prodávané zboží podle podílu trhů, jež ho v daném státě nabízejí. Pro zvýraznění zajímavých států propojíš body každého státu čarou. Aby byl graf přehledný a minimalistický, zjednodušíš pozadí na jednoduchou mřížku.
Toto cvičení je součástí kurzu
Vylepšení datových vizualizací v Pythonu
Pokyny k cvičení
- Nastav pozadí grafu na bílé s mřížkou.
- Přiřaď osám x a y bodového a čárového grafu hodnoty
'good'(prodávané zboží) a'prop selling'. - Odstraň všechna ohraničení grafu. Pamatuj, že ve výchozím nastavení
sns.despine()odstraní pouze horní a pravé ohraničení (spines)!
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Set background to white with grid
sns.set_style('____')
plt.scatter('____','____', marker = '_', alpha = 0.7, data = goods_by_state)
# Draw lines across goods for highlighted states
highlighted = goods_by_state.query("state in ['New Mexico','North Dakota','Vermont']")
sns.lineplot('____','____', 'state', data = highlighted, legend = False)
# Draw state name at end of lines
last_rows = highlighted.groupby('state', as_index = False).agg('first')
for _,row in last_rows.iterrows():
plt.annotate(row['state'], (row['good'], row['prop selling']),
ha = 'right', xytext = (5,0), textcoords = 'offset pixels')
# Remove all borders
sns.____(____ = ____, ____ = ____)
plt.show()