Gemiddelde, afwijking & standaardafwijking
Het gemiddelde beschrijft het midden van de data. De standaardafwijking beschrijft de spreiding van de data. Maar om twee variabelen te vergelijken, is het handig om beide te normaliseren. In deze oefening krijg je twee arrays met data die sterk gecorreleerd zijn, en bereken en visualiseer je de genormaliseerde afwijkingen van elke array.

Deze oefening maakt deel uit van de cursus
Introductie tot lineaire modellering in Python
Oefeninstructies
- Bereken de afwijkingen
dxendy. - Bereken de genormaliseerde afwijkingen
zxenzy. - Roep
plot_cdfs()aan om te zien hoe de ruwe en de genormaliseerde data zich verhouden.
Interactieve oefening met praktijkervaring
Probeer deze oefening door deze voorbeeldcode aan te vullen.
# Compute the deviations by subtracting the mean offset
dx = x - np.____(x)
dy = y - np.____(y)
# Normalize the data by dividing the deviations by the standard deviation
zx = dx / np.____(x)
zy = dy / np.____(y)
# Plot comparisons of the raw data and the normalized data
fig = plot_cdfs(dx, dy, zx, zy)