Začněte nyníZačněte zdarma

Využití mikro-oddílů a clusteringu dat

Při rychlém rozhovoru na chodbě ti vedoucí datový inženýr prozradil, že Snowflake používá clustering dat k řazení záznamů v mikro-oddílech podle pole year v tabulce olympic_medals. Máš několik dotazů, které pravidelně spouštíš nad touto tabulkou, a teď je chceš upravit tak, aby lépe využívaly mikro-oddíly a clustering dat Snowflake.

Funkce create_engine z modulu sqlalchemy je již naimportována a objekt připojení je uložen v proměnné conn.

Toto cvičení je součástí kurzu

Úvod do NoSQL

Zobrazit kurz

Pokyny k cvičení

  • Uprav dotaz Snowflake tak, aby vracel pouze záznamy o hrách, které se konaly v roce 2000 nebo později.
  • Vrať výsledky dotazu Snowflake jako pandas DataFrame a výslednou sadu vypiš.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Leverage the existing micro-partitions and data clustering
query = """
SELECT
	team,
    year,
    sport,
    event,
    medal
FROM olympic_medals
____ year >= ____;
"""

# Execute the query, print the results
results = conn.cursor().____(query).fetch_pandas_all()
print(____)
Upravit a spustit kód