CommencezCommencez gratuitement

Sous-ensemble de lignes

Une grande part de la science des données consiste à repérer les éléments intéressants de votre jeu de données. L'une des techniques les plus simples consiste à extraire un sous-ensemble de lignes qui répondent à certains critères. On parle parfois de filtrer des lignes ou de sélectionner des lignes.

Il existe de nombreuses façons de créer un sous-ensemble d'un DataFrame. La plus courante est d'utiliser des opérateurs relationnels qui renvoient True ou False pour chaque ligne, puis de passer ce résultat entre crochets.

dogs[dogs["height_cm"] > 60]
dogs[dogs["color"] == "tan"]

Vous pouvez filtrer plusieurs conditions en même temps en utilisant l'opérateur « et » au niveau binaire, &.

dogs[(dogs["height_cm"] > 60) & (dogs["color"] == "tan")]

homelessness est disponible et pandas est importé sous pd.

Cette activité fait partie du cours

Manipulation de données avec pandas

Voir le cours

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Filter for rows where individuals is greater than 10000
ind_gt_10k = ____

# See the result
print(ind_gt_10k)
Modifier et exécuter le code