Kom igångKom igång gratis

Förbehandla data

Det första steget i segmenteringsprocessen är att förbehandla data. Du ska använda logtransformation och sedan normalisera data för att göra det klart för klustring.

Datamängden med RFMT-värden har laddats in som datamart_rfmt. Biblioteket pandas är inläst som pd och numpy som np.

Utforska gärna den utökade RFMT-datamängden i konsolen.

Den här övningen är en del av kursen

Kundsegmentering i Python

Visa kurs

Övningsinstruktioner

  • Importera StandardScaler, initialisera den och lagra den som scaler.
  • Tillämpa logtransformation på de råa RFMT-data.
  • Initialisera skalaren och anpassa den till de logtransformerade data.
  • Transformera och lagra de skalade data som datamart_rfmt_normalized.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Import StandardScaler 
from ____.____ import ____

# Apply log transformation
datamart_rfmt_log = ____.____(____)

# Initialize StandardScaler and fit it 
scaler = ____(); ____.fit(____)

# Transform and store the scaled data as datamart_rfmt_normalized
datamart_rfmt_normalized = ____.____(____)
Redigera och kör kod