Sous-ensemble de lignes selon des variables catégorielles
Créer un sous-ensemble de données à partir d'une variable catégorielle implique souvent d'utiliser l'opérateur or (|) pour sélectionner des lignes appartenant à plusieurs catégories. Cela peut devenir fastidieux si, par exemple, vous voulez toutes les entités d'une des trois régions.
À la place, utilisez la méthode .isin(), qui vous permet de résoudre ce problème en écrivant une seule condition plutôt que trois conditions distinctes.
colors = ["brown", "black", "tan"]
condition = dogs["color"].isin(colors)
dogs[condition]
homelessness est disponible et pandas est importé sous le nom pd.
Cette activité fait partie du cours
Manipulation de données avec pandas
Instructions de l’exercice
Filtrez homelessness pour les cas où l'État du recensement des États-Unis state figure dans la liste des États du Mojave, canu, et assignez le résultat à mojave_homelessness. Affichez le résultat imprimé.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# The Mojave Desert states
canu = ["California", "Arizona", "Nevada", "Utah"]
# Filter for rows in the Mojave Desert states
mojave_homelessness = homelessness[____]
# See the result
print(mojave_homelessness)