ÎncepețiÎncepe gratuit

Setarea indexurilor pe mai multe niveluri

Indexurile pot fi construite și din mai multe coloane, formând un index pe mai multe niveluri (numit uneori index ierarhic). Această abordare implică un compromis.

Avantajul constă în faptul că indexurile pe mai multe niveluri fac mai naturală raționarea despre variabilele categorice imbricate. De exemplu, într-un studiu clinic, poți avea grupuri de control și de tratament. Fiecare subiect de test aparține unuia dintre aceste grupuri, ceea ce înseamnă că subiectul este imbricat în grupul de tratament. Similar, în setul de date cu temperaturi, orașul se află într-o anumită țară, deci putem spune că orașul este imbricat în țară.

Principalul dezavantaj este că sintaxa pentru manipularea indexurilor diferă de cea pentru manipularea coloanelor, astfel că trebuie să înveți două sintaxe și să urmărești modul în care sunt reprezentate datele.

pandas este încărcat ca pd. temperatures este disponibil.

Acest exercițiu face parte din cursul

Manipularea datelor cu pandas

Vezi cursul

Instrucțiuni pentru exercițiu

  • Setează indexul lui temperatures la coloanele "country" și "city" și atribuie rezultatul variabilei temperatures_ind.
  • Specifică două perechi țară/oraș de păstrat: "Brazil"/"Rio De Janeiro" și "Pakistan"/"Lahore", atribuindu-le variabilei rows_to_keep.
  • Afișează și filtrează temperatures_ind pentru rows_to_keep folosind .loc[].

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Index temperatures by country & city
temperatures_ind = ____

# List of tuples: Brazil, Rio De Janeiro & Pakistan, Lahore
rows_to_keep = [____]

# Subset for rows to keep
print(temperatures_ind.____)
Editează și rulează codul