Aan de slagBegin gratis

Gemiddelde, afwijking & standaardafwijking

Het gemiddelde beschrijft het midden van de data. De standaardafwijking beschrijft de spreiding van de data. Maar om twee variabelen te vergelijken, is het handig om beide te normaliseren. In deze oefening krijg je twee arrays met data die sterk gecorreleerd zijn, en bereken en visualiseer je de genormaliseerde afwijkingen van elke array.

Deze oefening maakt deel uit van de cursus

Introductie tot lineaire modellering in Python

Bekijk cursus

Oefeninstructies

  • Bereken de afwijkingen dx en dy.
  • Bereken de genormaliseerde afwijkingen zx en zy.
  • Roep plot_cdfs() aan om te zien hoe de ruwe en de genormaliseerde data zich verhouden.

Interactieve oefening met praktijkervaring

Probeer deze oefening door deze voorbeeldcode aan te vullen.

# Compute the deviations by subtracting the mean offset
dx = x - np.____(x)
dy = y - np.____(y)

# Normalize the data by dividing the deviations by the standard deviation
zx = dx / np.____(x)
zy = dy / np.____(y)

# Plot comparisons of the raw data and the normalized data
fig = plot_cdfs(dx, dy, zx, zy)
Code bewerken en uitvoeren