Średnia ze średnich
Chcesz poznać średnią liczbę użytkowników (num_users) przypadającą na transakcję dla całej firmy – dzięki temu sprawdzisz, czy transakcje Amira dotyczą większej czy mniejszej liczby użytkowników niż przeciętna transakcja firmowa. Problem polega na tym, że w ciągu ostatniego roku firma zrealizowała ponad dziesięć tysięcy transakcji, więc zebranie wszystkich danych jest nierealne. Zamiast tego oszacujesz średnią, pobierając kilka losowych próbek transakcji – to znacznie prostsze podejście niż gromadzenie danych od wszystkich pracowników firmy.
amir_deals jest dostępny, a dane dotyczące użytkowników dla wszystkich transakcji firmowych znajdziesz w all_deals. Załadowane są zarówno pandas jako pd, jak i numpy jako np.
To ćwiczenie jest częścią kursu
Wprowadzenie do statystyki w Pythonie
Instrukcje do ćwiczenia
- Ustaw ziarno losowości na
321. - Pobierz 30 próbek (z powtórzeniami) o rozmiarze 20 z
all_deals['num_users']i oblicz średnią każdej próbki. Przechowaj średnie próbek wsample_means. - Wyświetl średnią z
sample_means. - Wyświetl średnią kolumny
num_usersze zbioruamir_deals.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Set seed to 321
____
sample_means = []
# Loop 30 times to take 30 means
for i in range(____):
# Take sample of size 20 from num_users col of all_deals with replacement
cur_sample = ____
# Take mean of cur_sample
cur_mean = ____
# Append cur_mean to sample_means
sample_means.append(____)
# Print mean of sample_means
print(____)
# Print mean of num_users in amir_deals
print(____)