Statystyka inferencyjna
W celu zebrania kluczowych danych zdrowotnych do monitorowania wskaźnika masy ciała młodzieży, urzędnicy ds. zdrowia przeprowadzili ankietę na reprezentatywnej ogólnokrajowej próbie osób w wieku od 14 do 20 lat według stanu na 31 grudnia 1999 roku. Zbiór danych zawiera informacje o wieku Age, wzroście w calach Height_in, wadze w funtach Weight_lbs, płci Gender oraz odpowiedzi na pytanie wielokrotnego wyboru: „Jak oceniasz swoją wagę?" – describe_weight.
Oczyszczony zbiór danych z tej ankiety został wczytany jako youth_survey_clean. W tym ćwiczeniu obliczysz przedziały ufności.
Biblioteki pandas, NumPy oraz moduł statystyczny SciPy zostały wczytane odpowiednio jako pd, np i st.
To ćwiczenie jest częścią kursu
Analiza danych ankietowych w Pythonie
Instrukcje do ćwiczenia
- Oblicz przedział ufności dla prawdziwej średniej wzrostu w populacji,
Height_in, przy poziomie ufności 95%. - Oblicz przedział ufności dla prawdziwej średniej wzrostu w populacji,
Height_in, przy poziomie ufności 99%.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Find confidence interval for mean height with 95% confidence level
conf_95 = st.norm.interval(alpha = ____,
loc = np.mean(____),
scale = st.sem(____))
# Find confidence interval for mean height with 99% confidence level
conf_99 = st.norm.interval(alpha = ____,
loc = np.mean(____),
scale = st.sem(____))
print("conf_95 = ", conf_95)
print("conf_99 = ", conf_99)