Centrování a škálování ručně
Pracujeme se stejnou datovou sadou pojmenovanou data. Tvým úkolem teď bude data centrovat a škálovat ručně.
Knihovny pandas, numpy, seaborn a matplotlib.pyplot jsou načteny jako pd, np, sns a plt. Klidně si datovou sadu prozkoumej v konzoli.
Toto cvičení je součástí kurzu
Segmentace zákazníků v Pythonu
Pokyny k cvičení
- Centruj data odečtením průměrných hodnot od každého záznamu.
- Škáluj data vydělením každého záznamu směrodatnou odchylkou.
- Spoj obě předchozí operace a normalizuj data použitím centrování i škálování zároveň.
- Vypiš souhrnné statistiky, abys ověřil/a, že průměr je nula a směrodatná odchylka jedna, a výstup zaokrouhli na 2 desetinná místa.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Center the data by subtracting average values from each entry
data_centered = data - data.____()
# Scale the data by dividing each entry by standard deviation
data_scaled = ____ / ____.____()
# Normalize the data by applying both centering and scaling
data_normalized = (____ - data.____()) / data.____()
# Print summary statistics to make sure average is zero and standard deviation is one
print(data_normalized.____().round(____))