Začněte nyníZačněte zdarma

Efektivní využití funkcí v pandas

Vytváříš pythonovou aplikaci, která bude počítat souhrnné statistiky na základě proměnných vybraných uživatelem. Celá datová sada je poměrně rozsáhlá. Prozatím si kód nastavíš na části datové sady, která je předem načtená jako adult. Při vytváření znovupoužitelného procesu se zamysli nad tím, jak co nejefektivněji nastavit objekt GroupBy.

Toto cvičení je součástí kurzu

Working with Categorical Data in Python

Zobrazit kurz

Pokyny k cvičení

  • Vytvoř seznam názvů dvou proměnných vybraných uživatelem: "Education" a "Above/Below 50k".
  • Vytvoř objekt GroupBy s názvem gb, který použije user_list jako proměnné pro seskupení.
  • Vypočítej průměr sloupce "Hours/Week" napříč každou skupinou pomocí nejefektivnějšího přístupu, který byl ukázán ve videu.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Create a list of user-selected variables
user_list = ____

# Create a GroupBy object using this list
gb = ____

# Find the mean for the variable "Hours/Week" for each group - Be efficient!
print(____)
Upravit a spustit kód