Rovnost rozptylů
Různá odvětví přitahují různou míru investic od rizikových kapitalistů (VC). Pokud ale v daném vzorku investic narazíš na mírně odlišné průměrné investované částky, je opravdu důvod považovat tento rozdíl za statisticky významný? Přesně pro takové situace se hodí ANOVA. Jednou z klíčových podmínek pro ANOVA je však rovnost rozptylů ve všech skupinách vzorků. V tomto cvičení ji otestuješ pomocí Levenova testu rovnosti rozptylů.
DataFrame investments_df obsahuje investice ze tří odvětví (Biotechnology, Enterprise Software a Health Care). K dispozici máš také balíčky pandas jako pd, NumPy jako np, Matplotlib jako plt a balíček stats ze SciPy.
Toto cvičení je součástí kurzu
Základy statistické inference v Pythonu
Pokyny k cvičení
- Z
investments_dfvyber financování pro každýmarketzvlášť podle zadaných názvů sloupců. - Proveď Levenovy testy rovnosti rozptylů pro každou dvojici odvětví v tomto pořadí: (i) Biotechnology a Enterprise Software, (ii) Biotechnology a Health Care a (iii) Enterprise Software a Health Care, přiřazené k
statistic1,statistic2astatistic3. - V každém případě vrať Boolean, který udává, zda se zamítá nulová hypotéza o rovnosti rozptylů.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Select each industry separately
biotech_df = ____
enterprise_df = ____
health_df = ____
# Conduct Levene tests for equal variance between funding_total_usd for all pairs of industries
statistic_1, p_value_1 = ____
statistic_2, p_value_2 = ____
statistic_3, p_value_3 = ____
# Print if the p-value is significant at the 5% level
print(____)
print(____)
print(____)