Sous-ensemble de lignes
Une grande part de la science des données consiste à repérer les éléments intéressants de votre jeu de données. L'une des techniques les plus simples consiste à extraire un sous-ensemble de lignes qui répondent à certains critères. On parle parfois de filtrer des lignes ou de sélectionner des lignes.
Il existe de nombreuses façons de créer un sous-ensemble d'un DataFrame. La plus courante est d'utiliser des opérateurs relationnels qui renvoient True ou False pour chaque ligne, puis de passer ce résultat entre crochets.
dogs[dogs["height_cm"] > 60]
dogs[dogs["color"] == "tan"]
Vous pouvez filtrer plusieurs conditions en même temps en utilisant l'opérateur « et » au niveau binaire, &.
dogs[(dogs["height_cm"] > 60) & (dogs["color"] == "tan")]
homelessness est disponible et pandas est importé sous pd.
Cette activité fait partie du cours
Manipulation de données avec pandas
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Filter for rows where individuals is greater than 10000
ind_gt_10k = ____
# See the result
print(ind_gt_10k)