Filtrarea datelor
Îți amintești din exercițiile anterioare că cele mai multe vânzări de bilete aveau loc în Los Angeles, ceea ce îngreuna analiza performanțelor celorlalte locații. Dacă vrem să analizăm un subset al datelor – de exemplu, o singură locație – va trebui să filtrăm datele.
Acest exercițiu face parte din cursul
Python pentru utilizatorii de foi de calcul
Instrucțiuni pentru exercițiu
- Filtrează coloana
theater_locationdin sales pentru a păstra doar înregistrările cu valoareaNew York– nu uita ghilimelele! - Afișează primele rânduri din datele pentru New York.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Import the pandas package as pd
import pandas as pd
# Read in the Excel file
sales = pd.read_excel('ticket_sales.xlsx')
# Filter for New York sales only
new_york_sales = sales[sales[____] == ____].reset_index(drop=True)
# Print the first 5 rows of new_york_sales
____(new_york_sales.____())