Využití mikro-oddílů a clusteringu dat
Při rychlém rozhovoru na chodbě ti vedoucí datový inženýr prozradil, že Snowflake používá clustering dat k řazení záznamů v mikro-oddílech podle pole year v tabulce olympic_medals. Máš několik dotazů, které pravidelně spouštíš nad touto tabulkou, a teď je chceš upravit tak, aby lépe využívaly mikro-oddíly a clustering dat Snowflake.
Funkce create_engine z modulu sqlalchemy je již naimportována a objekt připojení je uložen v proměnné conn.
Toto cvičení je součástí kurzu
Úvod do NoSQL
Pokyny k cvičení
- Uprav dotaz Snowflake tak, aby vracel pouze záznamy o hrách, které se konaly v roce 2000 nebo později.
- Vrať výsledky dotazu Snowflake jako
pandasDataFramea výslednou sadu vypiš.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Leverage the existing micro-partitions and data clustering
query = """
SELECT
team,
year,
sport,
event,
medal
FROM olympic_medals
____ year >= ____;
"""
# Execute the query, print the results
results = conn.cursor().____(query).fetch_pandas_all()
print(____)