Використання мікророзділів і кластеризації даних
Під час короткої розмови в коридорі ваша техлідерка з інженерії даних поділилася, що Snowflake використовує кластеризацію даних, щоб упорядковувати записи всередині мікророзділів за полем year у таблиці olympic_medals. Ви маєте кілька запитів, які регулярно запускаєте до цієї таблиці, і хочете оновити їх, щоб краще використати мікророзділи Snowflake і кластеризацію даних.
Функцію create_engine з модуля sqlalchemy імпортовано, створено об'єкт з'єднання та збережено у змінній conn.
Ця вправа є частиною курсу
Вступ до NoSQL
Інструкції до вправи
- Оновіть запит до Snowflake так, щоб він повертав лише записи про Ігри, які відбулися у 2000 році або пізніше.
- Поверніть результати запиту Snowflake як
DataFrameбібліотекиpandasі виведіть набір результатів.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Leverage the existing micro-partitions and data clustering
query = """
SELECT
team,
year,
sport,
event,
medal
FROM olympic_medals
____ year >= ____;
"""
# Execute the query, print the results
results = conn.cursor().____(query).fetch_pandas_all()
print(____)