Centrování a škálování pomocí StandardScaler()
Načetli jsme stejný dataset s názvem data. Tvým úkolem teď bude centrovat a škálovat data pomocí StandardScaler z knihovny sklearn.
Knihovna pandas, numpy, seaborn a matplotlib.pyplot jsou načteny jako pd, np, sns a plt. Také jsme importovali StandardScaler.
Dataset si klidně prozkoumej v konzoli.
Toto cvičení je součástí kurzu
Segmentace zákazníků v Pythonu
Pokyny k cvičení
- Inicializuj instanci
StandardScalerjakoscalera napasuj ji nadata. - Transformuj
data– vycentruj je a škáluj pomocíscaler. - Vytvoř pandas DataFrame z
data_normalizeda přidej index a názvy sloupců zdata. - Vypiš souhrnné statistiky, aby ses ujistil/a, že průměr je nula a směrodatná odchylka je jedna, a výsledky zaokrouhli na 2 desetinná místa.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Initialize a scaler
scaler = ____()
# Fit the scaler
____.____(data)
# Scale and center the data
data_normalized = ____.____(data)
# Create a pandas DataFrame
data_normalized = pd.DataFrame(____, index=data.index, columns=data.columns)
# Print summary statistics
print(data_normalized.____().round(____))