Zacznij terazZacznij za darmo

Porównanie za pomocą dwóch KDE

Wyobraź sobie, że pracujesz dla czołowego dostawcy filtrów powietrza. Twoja firma poprosiła cię o przygotowanie raportu wyjaśniającego, dlaczego 2012 rok był wyjątkowo dobry dla sprzedaży filtrów ozonu (O3). Pobierasz pomocne dane dotyczące zanieczyszczeń z USGS i chcesz stworzyć przejrzystą wizualizację porównującą ogólny wzorzec zanieczyszczenia O3 w 2012 roku z pozostałymi latami w zbiorze danych.

Aby to zrobić, możesz zbudować dwa nałożone na siebie wykresy jądrowego estymatora gęstości (KDE): jeden dla danych O3 z roku 2012 i jeden dla wszystkich pozostałych lat.

To ćwiczenie jest częścią kursu

Ulepszanie wizualizacji danych w Pythonie

Zobacz kurs

Instrukcje do ćwiczenia

  • Przefiltruj dane w pierwszym wywołaniu sns.kdeplot(), aby uwzględnić tylko rok 2012.
  • Wypełnij obszar pod pierwszym KDE, używając argumentu shade.
  • Dodaj etykietę '2012' do legendy wykresu.
  • Powtórz te trzy kroki dla drugiego wywołania sns.kdeplot(), ale przefiltruj dane tak, aby wykluczyć rok 2012. Użyj etykiety 'other years'.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Filter dataset to the year 2012
sns.kdeplot(pollution[pollution.year ____ ____].O3, 
            # Shade under kde and add a helpful label
            shade = ____,
            ____ = '____')

# Filter dataset to everything except the year 2012
sns.kdeplot(pollution[pollution.year ____ ____].O3, 
            # Again, shade under kde and add a helpful label
            shade = ____,
            ____ = '____')
plt.show()
Edytuj i uruchom kod