Utnyttja mikropartitioner och dataklustring
Under ett kort samtal i korridoren berättade din Lead Data Engineer att Snowflake använder dataklustring för att sortera data inom mikropartitioner baserat på fältet year i tabellen olympic_medals. Du kör ett antal frågor regelbundet mot den här tabellen och vill uppdatera dem för att bättre dra nytta av Snowflakes mikropartitioner och dataklustring.
Funktionen create_engine från modulen sqlalchemy har importerats, och ett anslutningsobjekt har skapats och lagrats i variabeln conn.
Den här övningen är en del av kursen
Introduktion till NoSQL
Övningsinstruktioner
- Uppdatera Snowflake-frågan så att den bara returnerar poster för tävlingar som ägde rum år 2000 eller senare.
- Returnera resultaten av Snowflake-frågan som en
pandasDataFrameoch skriv ut resultatmängden.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Leverage the existing micro-partitions and data clustering
query = """
SELECT
team,
year,
sport,
event,
medal
FROM olympic_medals
____ year >= ____;
"""
# Execute the query, print the results
results = conn.cursor().____(query).fetch_pandas_all()
print(____)