Předzpracování dat
Prvním krokem segmentačního procesu je předzpracování dat. Použiješ logaritmickou transformaci a následně data normalizuješ, aby byla připravená pro clustering.
Dataset s hodnotami RFMT je načtený jako datamart_rfmt. Knihovna pandas je dostupná jako pd a numpy jako np.
Klidně si rozšířený dataset RFMT prozkoumej v konzoli.
Toto cvičení je součástí kurzu
Segmentace zákazníků v Pythonu
Pokyny k cvičení
- Importuj
StandardScaler, inicializuj ho a ulož jakoscaler. - Aplikuj logaritmickou transformaci na nezpracovaná data RFMT.
- Inicializuj scaler a přizpůsob ho logaritmicky transformovaným datům.
- Transformuj data a ulož je jako
datamart_rfmt_normalized.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Import StandardScaler
from ____.____ import ____
# Apply log transformation
datamart_rfmt_log = ____.____(____)
# Initialize StandardScaler and fit it
scaler = ____(); ____.fit(____)
# Transform and store the scaled data as datamart_rfmt_normalized
datamart_rfmt_normalized = ____.____(____)