ÎncepețiÎncepe gratuit

Filtrarea datelor

Îți amintești din exercițiile anterioare că cele mai multe vânzări de bilete aveau loc în Los Angeles, ceea ce îngreuna analiza performanțelor celorlalte locații. Dacă vrem să analizăm un subset al datelor – de exemplu, o singură locație – va trebui să filtrăm datele.

Acest exercițiu face parte din cursul

Python pentru utilizatorii de foi de calcul

Vezi cursul

Instrucțiuni pentru exercițiu

  • Filtrează coloana theater_location din sales pentru a păstra doar înregistrările cu valoarea New York – nu uita ghilimelele!
  • Afișează primele rânduri din datele pentru New York.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Import the pandas package as pd
import pandas as pd

# Read in the Excel file
sales = pd.read_excel('ticket_sales.xlsx')

# Filter for New York sales only
new_york_sales = sales[sales[____] == ____].reset_index(drop=True)

# Print the first 5 rows of new_york_sales
____(new_york_sales.____())
Editează și rulează codul