Sammanfattande statistik
Som du kanske minns från föregående lektion erbjuder NannyML fem metoder för att spåra statistiska förändringar i dina särdrag.
I den här övningen fokuserar du på särdragskolumnen lead_time från hotellbokningsdatamängden, som anger hur många dagar i förväg en bokning gjordes. Genom att använda statistik baserad på summering, median och standardavvikelse kan du få värdefulla insikter om hur kundernas bokningsbeteende har förändrats över tid.
Observera att både referens- och analysuppsättningarna samt biblioteket nannyml redan är inlästa och redo att användas.
Den här övningen är en del av kursen
Övervakning av maskininlärning i Python
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Define analyzed column
analyzed_column = [____]
# Intialize sum values calculator
sum_calc = ____.____(
____=____,
chunk_period='m',
timestamp_column_name='timestamp'
)
# Fit, calculate and plot the results
sum_calc.fit(reference)
sum_calc_res = sum_calc.calculate(analysis)
sum_calc_res.plot().show()