Невипадкове призначення піддослідних
Сільськогосподарська компанія проводить експеримент, щоб виміряти, як годування овець різними видами трави впливає на їхню вагу. Вони попросили вашу допомогу правильно налаштувати експеримент. Один з менеджерів сказав, що можна призначити піддослідних, узявши перші 250 рядків з датафрейма, і цього має бути достатньо.
Ваше завдання — аналітично показати, чому це може бути не найкраща ідея. Призначте піддослідних у дві групи за невипадковим принципом (перші 250 рядків) і порівняйте відмінності в описовій статистиці.
Ви отримали датафрейм weights, який містить стовпець із weight вівці та унікальний стовпець id.
numpy і pandas імпортовано як np та pd відповідно.
Ця вправа є частиною курсу
Експериментальний дизайн у Python
Інструкції до вправи
- Використайте зрізи датафрейма, щоб помістити перші 250 рядків
weightsуgroup1_non_rand, а решту — уgroup2_non_rand. - Згенеруйте описову статистику для двох груп і об'єднайте їх в один датафрейм.
- Виведіть результат, щоб побачити відмінності.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Non-random assignment
group1_non_rand = ____
group2_non_rand = ____
# Compare descriptive statistics of groups
compare_df_non_rand = ____([group1_non_rand['weight'].____, group2_non_rand['weight'].____], axis=1)
compare_df_non_rand.columns = ['group1', 'group2']
# Print to assess
print(____)