Efektivní využití funkcí v pandas
Vytváříš pythonovou aplikaci, která bude počítat souhrnné statistiky na základě proměnných vybraných uživatelem. Celá datová sada je poměrně rozsáhlá. Prozatím si kód nastavíš na části datové sady, která je předem načtená jako adult. Při vytváření znovupoužitelného procesu se zamysli nad tím, jak co nejefektivněji nastavit objekt GroupBy.
Toto cvičení je součástí kurzu
Working with Categorical Data in Python
Pokyny k cvičení
- Vytvoř seznam názvů dvou proměnných vybraných uživatelem:
"Education"a"Above/Below 50k". - Vytvoř objekt
GroupBys názvemgb, který použijeuser_listjako proměnné pro seskupení. - Vypočítej průměr sloupce
"Hours/Week"napříč každou skupinou pomocí nejefektivnějšího přístupu, který byl ukázán ve videu.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Create a list of user-selected variables
user_list = ____
# Create a GroupBy object using this list
gb = ____
# Find the mean for the variable "Hours/Week" for each group - Be efficient!
print(____)