Gruppera data i intervall
När datan på x-axeln är ett kontinuerligt värde kan det vara användbart att dela in den i olika intervall för att få en tydligare visualisering av förändringarna i datan.
I den här övningen tittar vi på sambandet mellan studieavgift och antalet studenter på grundnivå, förkortat UG i den här datamängden. Vi börjar med ett scatter-diagram och undersöker sedan hur olika intervallstorlekar påverkar visualiseringen.
Den här övningen är en del av kursen
Datavisualisering med Seaborn – fortsättningskurs
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Create a scatter plot by disabling the regression line
sns.regplot(data=df,
y='Tuition',
x='UG',
fit_reg=____)
plt.show()
plt.clf()