Identyfikowanie wartości odstających
Kontynuujemy pracę z naszym zbiorem danych laptops i zajmiemy się wartościami odstającymi. W tym ćwiczeniu użyjemy pierwszej techniki omówionej na slajdach – odchylenia standardowego do identyfikowania wartości ekstremalnych – ponieważ to najczęściej stosowane podejście w praktyce.
Obliczysz statystyki opisowe i granice dla wartości odstających, zidentyfikujesz wiersze je zawierające, a następnie usuniesz je ze zbioru danych. Będziesz pracować głównie z kolumną Price.
To ćwiczenie jest częścią kursu
Ćwiczenie pytań rekrutacyjnych ze statystyki w Pythonie
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Calculate the mean and std
mean, std = ____, ____