Kom igångKom igång gratis

Lika varians

Olika branscher attraherar olika stora investeringar från riskkapitalister (VC). Men om du tittar på ett urval av riskkapitalinvesteringar och ser något olika genomsnittliga investeringsbelopp – är det rimligt att anta att skillnaden är statistiskt signifikant? Det är just en sådan situation som ANOVA är gjord för. En grundläggande förutsättning för ANOVA är dock lika varians mellan alla grupper i urvalet. I den här övningen testar du det med Levenes test för lika varians.

En pandas DataFrame med investeringar inom tre branscher (Biotechnology, Enterprise Software och Health Care) har laddats in åt dig i investments_df. Paketen pandas som pd, NumPy som np, Matplotlib som plt och paketet stats från SciPy har också laddats in.

Den här övningen är en del av kursen

Grunderna i inferens med Python

Visa kurs

Övningsinstruktioner

  • Välj ut finansieringen för varje market individuellt från investments_df med hjälp av de angivna kolumnnamnen.
  • Genomför Levene-test för lika varians mellan varje par av branscher i följande ordning: (i) Biotechnology och Enterprise Software, (ii) Biotechnology och Health Care samt (iii) Enterprise Software och Health Care, motsvarande statistic1, statistic2 respektive statistic3.
  • Returnera i varje fall ett booleskt värde som anger om nollhypotesen om lika varians förkastas.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Select each industry separately
biotech_df = ____
enterprise_df = ____
health_df = ____

# Conduct Levene tests for equal variance between funding_total_usd for all pairs of industries
statistic_1, p_value_1 = ____
statistic_2, p_value_2 = ____
statistic_3, p_value_3 = ____

# Print if the p-value is significant at the 5% level
print(____)
print(____)
print(____)
Redigera och kör kod