Lika varians
Olika branscher attraherar olika stora investeringar från riskkapitalister (VC). Men om du tittar på ett urval av riskkapitalinvesteringar och ser något olika genomsnittliga investeringsbelopp – är det rimligt att anta att skillnaden är statistiskt signifikant? Det är just en sådan situation som ANOVA är gjord för. En grundläggande förutsättning för ANOVA är dock lika varians mellan alla grupper i urvalet. I den här övningen testar du det med Levenes test för lika varians.
En pandas DataFrame med investeringar inom tre branscher (Biotechnology, Enterprise Software och Health Care) har laddats in åt dig i investments_df. Paketen pandas som pd, NumPy som np, Matplotlib som plt och paketet stats från SciPy har också laddats in.
Den här övningen är en del av kursen
Grunderna i inferens med Python
Övningsinstruktioner
- Välj ut finansieringen för varje
marketindividuellt fråninvestments_dfmed hjälp av de angivna kolumnnamnen. - Genomför Levene-test för lika varians mellan varje par av branscher i följande ordning: (i) Biotechnology och Enterprise Software, (ii) Biotechnology och Health Care samt (iii) Enterprise Software och Health Care, motsvarande
statistic1,statistic2respektivestatistic3. - Returnera i varje fall ett booleskt värde som anger om nollhypotesen om lika varians förkastas.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Select each industry separately
biotech_df = ____
enterprise_df = ____
health_df = ____
# Conduct Levene tests for equal variance between funding_total_usd for all pairs of industries
statistic_1, p_value_1 = ____
statistic_2, p_value_2 = ____
statistic_3, p_value_3 = ____
# Print if the p-value is significant at the 5% level
print(____)
print(____)
print(____)