Середнє зі середніх
Ви хочете дізнатися, якою є середня кількість користувачів (num_users) на угоду. Але вас цікавить показник для всієї компанії, щоб зрозуміти, чи мають угоди Аміра більше або менше користувачів, ніж середня угода по компанії. Проблема в тому, що за минулий рік компанія опрацювала понад десять тисяч угод, тож зібрати всі дані нереалістично. Замість цього ви оціните середнє, взявши кілька випадкових вибірок угод, адже це значно простіше, ніж збирати дані з усієї компанії.
amir_deals доступний, а дані про користувачів для всіх угод компанії доступні в all_deals. Бібліотеки pandas як pd та numpy як np завантажено.
Ця вправа є частиною курсу
Вступ до Statistics у Python
Інструкції до вправи
- Встановіть випадкове зерно на
321. - Візьміть 30 вибірок (із поверненням) розміру 20 з
all_deals['num_users']і обчисліть середнє кожної вибірки. Збережіть середні вибірок уsample_means. - Виведіть середнє для
sample_means. - Виведіть середнє для стовпця
num_usersуamir_deals.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Set seed to 321
____
sample_means = []
# Loop 30 times to take 30 means
for i in range(____):
# Take sample of size 20 from num_users col of all_deals with replacement
cur_sample = ____
# Take mean of cur_sample
cur_mean = ____
# Append cur_mean to sample_means
sample_means.append(____)
# Print mean of sample_means
print(____)
# Print mean of num_users in amir_deals
print(____)