Utforska med grundläggande transformationer
Du vill undersöka om befolkningstalet i en delstat korrelerar med antalet varor som säljs på bondsmarknader. För att ta reda på det logaritmerar du befolkningstalet och ritar ett spridningsdiagram mot antalet varor som säljs per marknad. Från dina tidigare utforskningar av datamängden vet du att det kommer att finnas mycket överlapp, så för att lättare urskilja mönstren vill du minska markörernas opacitet.
Den här övningen är en del av kursen
Förbättra dina datavisualiseringar i Python
Övningsinstruktioner
- Använd
numpy(importerat somnp) för att skapa en ny kolumn:log_pop, genom att ta logaritmen av delstatens befolkningstal. - Skicka den nyligen skapade logaritmerade kolumnen till spridningsdiagrammets x-mappning.
- Sätt spridningsdiagrammets opacitet till 25 % för att synliggöra överlapp.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Create a new logged population column
markets['____'] = np.____(markets['____'])
# Draw a scatterplot of log-population to # of items sold
sns.scatterplot(x = '____',
y = 'num_items_sold',
# Reduce point opacity to show overlap
____ = ____,
data = markets)
plt.show()