Kom igångKom igång gratis

Medelvärdet av medelvärden

Du vill veta det genomsnittliga antalet användare (num_users) per affär, men du vill ha det här talet för hela företaget så att du kan se om Amirs affärer har fler eller färre användare än företagets genomsnittliga affär. Problemet är att företaget under det senaste året har arbetat med fler än tiotusen affärer, vilket gör det orealistiskt att samla in all data. Istället ska du uppskatta medelvärdet genom att ta flera slumpmässiga urval av affärer, eftersom det är mycket enklare än att samla in data från hela företaget.

amir_deals finns tillgänglig och användardata för alla företagets affärer finns i all_deals. Både pandas som pd och numpy som np är inlästa.

Den här övningen är en del av kursen

Introduktion till statistik i Python

Visa kurs

Övningsinstruktioner

  • Sätt det slumpmässiga fröet till 321.
  • Ta 30 urval (med återläggning) av storlek 20 från all_deals['num_users'] och beräkna medelvärdet för varje urval. Lagra urvalsmedelvärden i sample_means.
  • Skriv ut medelvärdet av sample_means.
  • Skriv ut medelvärdet för kolumnen num_users i amir_deals.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Set seed to 321
____

sample_means = []
# Loop 30 times to take 30 means
for i in range(____):
  # Take sample of size 20 from num_users col of all_deals with replacement
  cur_sample = ____
  # Take mean of cur_sample
  cur_mean = ____
  # Append cur_mean to sample_means
  sample_means.append(____)

# Print mean of sample_means
print(____)

# Print mean of num_users in amir_deals
print(____)
Redigera och kör kod