Среднее из средних
Вы хотите узнать среднее количество пользователей (num_users) на одну сделку по всей компании — чтобы понять, больше или меньше пользователей в сделках Амира по сравнению с общим показателем. Сложность в том, что за прошедший год компания заключила более десяти тысяч сделок, поэтому собрать все данные нереально. Вместо этого вы оцените среднее значение, взяв несколько случайных выборок сделок — это гораздо проще, чем собирать данные по всей компании.
amir_deals доступен, а данные о пользователях по всем сделкам компании находятся в all_deals. Библиотеки pandas как pd и numpy как np уже загружены.
Это упражнение является частью курса
Введение в статистику на Python
Инструкции к упражнению
- Установите случайное зерно равным
321. - Возьмите 30 выборок (с возвращением) размером 20 из
all_deals['num_users']и вычислите среднее для каждой выборки. Сохраните средние значения выборок вsample_means. - Выведите среднее значение
sample_means. - Выведите среднее значение столбца
num_usersизamir_deals.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Set seed to 321
____
sample_means = []
# Loop 30 times to take 30 means
for i in range(____):
# Take sample of size 20 from num_users col of all_deals with replacement
cur_sample = ____
# Take mean of cur_sample
cur_mean = ____
# Append cur_mean to sample_means
sample_means.append(____)
# Print mean of sample_means
print(____)
# Print mean of num_users in amir_deals
print(____)