Efektywne korzystanie z funkcji pandas
Tworzysz aplikację w Pythonie, która będzie obliczać statystyki podsumowujące na podstawie zmiennych wybranych przez użytkownika. Pełny zbiór danych jest dość duży. Na razie konfigurujesz kod na fragmencie zbioru, wczytanym jako adult. Tworząc proces wielokrotnego użytku, zastanów się, jak jak najefektywniej skonfigurować obiekt GroupBy.
To ćwiczenie jest częścią kursu
Praca z danymi kategorycznymi w Pythonie
Instrukcje do ćwiczenia
- Utwórz listę nazw dwóch zmiennych wybranych przez użytkownika:
"Education"i"Above/Below 50k". - Utwórz obiekt
GroupByo nazwiegb, używającuser_listjako zmiennych grupujących. - Oblicz średnią kolumny
"Hours/Week"dla każdej grupy, stosując najbardziej efektywne podejście omówione w filmie.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Create a list of user-selected variables
user_list = ____
# Create a GroupBy object using this list
gb = ____
# Find the mean for the variable "Hours/Week" for each group - Be efficient!
print(____)