Kom igångKom igång gratis

Utnyttja mikropartitioner och dataklustring

Under ett kort samtal i korridoren berättade din Lead Data Engineer att Snowflake använder dataklustring för att sortera data inom mikropartitioner baserat på fältet year i tabellen olympic_medals. Du kör ett antal frågor regelbundet mot den här tabellen och vill uppdatera dem för att bättre dra nytta av Snowflakes mikropartitioner och dataklustring.

Funktionen create_engine från modulen sqlalchemy har importerats, och ett anslutningsobjekt har skapats och lagrats i variabeln conn.

Den här övningen är en del av kursen

Introduktion till NoSQL

Visa kurs

Övningsinstruktioner

  • Uppdatera Snowflake-frågan så att den bara returnerar poster för tävlingar som ägde rum år 2000 eller senare.
  • Returnera resultaten av Snowflake-frågan som en pandas DataFrame och skriv ut resultatmängden.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Leverage the existing micro-partitions and data clustering
query = """
SELECT
	team,
    year,
    sport,
    event,
    medal
FROM olympic_medals
____ year >= ____;
"""

# Execute the query, print the results
results = conn.cursor().____(query).fetch_pandas_all()
print(____)
Redigera och kör kod