Filtrowanie wierszy
Duża część pracy w data science polega na znajdowaniu interesujących fragmentów zbioru danych. Jedną z najprostszych technik jest wybranie podzbioru wierszy spełniających określone kryteria. Tę operację często nazywa się filtrowaniem wierszy lub selekcją wierszy.
Istnieje wiele sposobów na podzbiór DataFrame'a – najpopularniejszy polega na użyciu operatorów relacyjnych, które zwracają True lub False dla każdego wiersza, a następnie przekazaniu wyniku w nawiasach kwadratowych.
dogs[dogs["height_cm"] > 60]
dogs[dogs["color"] == "tan"]
Można też filtrować według wielu warunków jednocześnie, używając operatora bitowego „i", czyli &.
dogs[(dogs["height_cm"] > 60) & (dogs["color"] == "tan")]
homelessness jest dostępny, a pandas jest załadowany jako pd.
To ćwiczenie jest częścią kursu
Manipulacja danymi z pandas
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Filter for rows where individuals is greater than 10000
ind_gt_10k = ____
# See the result
print(ind_gt_10k)