Inferenční statistika
Aby mohli zdravotní úředníci sledovat důležité zdravotní ukazatele v rámci indexu tělesné hmotnosti mládeže, rozeslali celostátně reprezentativní průzkum mezi mladými lidmi ve věku 14 až 20 let k 31. prosinci 1999. Dataset sleduje věk Age, výšku v palcích Height_in, váhu v librách Weight_lbs, pohlaví Gender a odpověď na otázku s výběrem: „Jak bys popsal/a svoji váhu?" describe_weight.
Očištěná verze datasetu z tohoto průzkumu je načtena jako youth_survey_clean. V tomto cvičení budeš počítat intervaly spolehlivosti.
Knihovny pandas, NumPy a balíček statistik ze SciPy jsou načteny jako pd, np a st.
Toto cvičení je součástí kurzu
Analýza dat z průzkumů v Pythonu
Pokyny k cvičení
- Vypočítej interval spolehlivosti pro skutečný průměr výšky populace
Height_inpři 95% hladině spolehlivosti. - Vypočítej interval spolehlivosti pro skutečný průměr výšky populace
Height_inpři 99% hladině spolehlivosti.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Find confidence interval for mean height with 95% confidence level
conf_95 = st.norm.interval(alpha = ____,
loc = np.mean(____),
scale = st.sem(____))
# Find confidence interval for mean height with 99% confidence level
conf_99 = st.norm.interval(alpha = ____,
loc = np.mean(____),
scale = st.sem(____))
print("conf_95 = ", conf_95)
print("conf_99 = ", conf_99)