Porównanie za pomocą dwóch KDE
Wyobraź sobie, że pracujesz dla czołowego dostawcy filtrów powietrza. Twoja firma poprosiła cię o przygotowanie raportu wyjaśniającego, dlaczego 2012 rok był wyjątkowo dobry dla sprzedaży filtrów ozonu (O3). Pobierasz pomocne dane dotyczące zanieczyszczeń z USGS i chcesz stworzyć przejrzystą wizualizację porównującą ogólny wzorzec zanieczyszczenia O3 w 2012 roku z pozostałymi latami w zbiorze danych.
Aby to zrobić, możesz zbudować dwa nałożone na siebie wykresy jądrowego estymatora gęstości (KDE): jeden dla danych O3 z roku 2012 i jeden dla wszystkich pozostałych lat.
To ćwiczenie jest częścią kursu
Ulepszanie wizualizacji danych w Pythonie
Instrukcje do ćwiczenia
- Przefiltruj dane w pierwszym wywołaniu
sns.kdeplot(), aby uwzględnić tylko rok2012. - Wypełnij obszar pod pierwszym KDE, używając argumentu
shade. - Dodaj etykietę
'2012'do legendy wykresu. - Powtórz te trzy kroki dla drugiego wywołania
sns.kdeplot(), ale przefiltruj dane tak, aby wykluczyć rok2012. Użyj etykiety'other years'.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Filter dataset to the year 2012
sns.kdeplot(pollution[pollution.year ____ ____].O3,
# Shade under kde and add a helpful label
shade = ____,
____ = '____')
# Filter dataset to everything except the year 2012
sns.kdeplot(pollution[pollution.year ____ ____].O3,
# Again, shade under kde and add a helpful label
shade = ____,
____ = '____')
plt.show()