Förbehandla data
Det första steget i segmenteringsprocessen är att förbehandla data. Du ska använda logtransformation och sedan normalisera data för att göra det klart för klustring.
Datamängden med RFMT-värden har laddats in som datamart_rfmt. Biblioteket pandas är inläst som pd och numpy som np.
Utforska gärna den utökade RFMT-datamängden i konsolen.
Den här övningen är en del av kursen
Kundsegmentering i Python
Övningsinstruktioner
- Importera StandardScaler, initialisera den och lagra den som
scaler. - Tillämpa logtransformation på de råa RFMT-data.
- Initialisera skalaren och anpassa den till de logtransformerade data.
- Transformera och lagra de skalade data som
datamart_rfmt_normalized.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Import StandardScaler
from ____.____ import ____
# Apply log transformation
datamart_rfmt_log = ____.____(____)
# Initialize StandardScaler and fit it
scaler = ____(); ____.fit(____)
# Transform and store the scaled data as datamart_rfmt_normalized
datamart_rfmt_normalized = ____.____(____)