Розмір вибірки для середніх
Під час планування A/B-тесту ви, як Data Scientist, відповідаєте за перевірку, чи взагалі доцільно проводити тест. Це означає, що потрібно відповісти на кілька запитань: чи маємо ми достатній трафік? Як виміряти «достатній»? Яку мінімальну різницю ми можемо виявити за наявного розміру вибірки? Скільки часу має тривати експеримент? І не лише це.
У цій вправі ви обчислите мінімальний розмір вибірки, потрібний для виявлення статистично значущої різниці певної величини між базовим середнім значенням order_value для контрольної групи та новим дизайном, який тестують. Бібліотеки pandas, numpy, matplotlib, seaborn і датафрейм checkout уже імпортовано та завантажено для вас, так само як і power з statsmodels.stats.
Ця вправа є частиною курсу
A/B Testing на Python
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Calculate and print the baseline mean and standard deviation
mean_B = ____
print(mean_B)
std_B = ____
print(std_B)