CommencezCommencez gratuitement

Comparer avec deux KDE

Imaginez que vous travaillez pour le fournisseur de filtres à air numéro un. Votre entreprise vous demande de préparer un rapport expliquant pourquoi 2012 a été une année particulièrement favorable aux ventes de votre filtre à ozone (O3). Vous avez téléversé des données utiles sur la pollution depuis l'USGS et vous souhaitez créer une visualisation concise qui compare la tendance générale de la pollution à l'O3 en 2012 à toutes les autres années disponibles.

Pour ce faire, vous pouvez tracer deux courbes de densité par noyau superposées (KDE) : une pour les données d'O3 de 2012 et une pour toutes les autres années.

Cette activité fait partie du cours

Améliorer vos visualisations de données en Python

Voir le cours

Instructions de l’exercice

  • Filtrez les données dans le premier appel à sns.kdeplot() pour inclure uniquement l'année 2012.
  • Ombragez sous la première KDE avec l'argument shade.
  • Ajoutez l'étiquette '2012' pour la légende du graphique.
  • Répétez les trois premières étapes pour le deuxième appel à sns.kdeplot(), mais filtrez les données pour exclure 2012. Utilisez l'étiquette 'other years'.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Filter dataset to the year 2012
sns.kdeplot(pollution[pollution.year ____ ____].O3, 
            # Shade under kde and add a helpful label
            shade = ____,
            ____ = '____')

# Filter dataset to everything except the year 2012
sns.kdeplot(pollution[pollution.year ____ ____].O3, 
            # Again, shade under kde and add a helpful label
            shade = ____,
            ____ = '____')
plt.show()
Modifier et exécuter le code