Gegevens in klassen indelen
Als de gegevens op de x-as een continue waarde zijn, kan het handig zijn om ze in verschillende klassen (bins) op te delen om de veranderingen in de gegevens beter te kunnen visualiseren.
In deze oefening bekijken we de relatie tussen het collegegeld (Tuition) en de
bachelorpopulatie, in deze gegevens afgekort als UG. We beginnen met een
scatterplot van de data en onderzoeken daarna wat het effect is van verschillende klassengroottes op de
visualisatie.
Deze oefening maakt deel uit van de cursus
Gevorderde datavisualisatie met Seaborn
Interactieve oefening met praktijkervaring
Probeer deze oefening door deze voorbeeldcode aan te vullen.
# Create a scatter plot by disabling the regression line
sns.regplot(data=df,
y='Tuition',
x='UG',
fit_reg=____)
plt.show()
plt.clf()