Использование микроразделов и кластеризации данных
Во время короткого разговора в коридоре ваш ведущий инженер по данным сообщила вам, что Snowflake использует кластеризацию данных для сортировки записей внутри микроразделов по полю year в таблице olympic_medals. У вас есть несколько запросов, которые вы регулярно выполняете к этой таблице, — и вы хотите обновить их, чтобы лучше задействовать возможности микроразделов и кластеризации данных в Snowflake.
Функция create_engine из модуля sqlalchemy уже импортирована, а объект подключения создан и сохранён в переменной conn.
Это упражнение является частью курса
Введение в NoSQL
Инструкции к упражнению
- Обновите запрос к Snowflake так, чтобы он возвращал только записи об играх, проходивших в 2000 году и позднее.
- Получите результаты запроса к Snowflake в виде
DataFrameбиблиотекиpandasи выведите результирующий набор данных.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Leverage the existing micro-partitions and data clustering
query = """
SELECT
team,
year,
sport,
event,
medal
FROM olympic_medals
____ year >= ____;
"""
# Execute the query, print the results
results = conn.cursor().____(query).fetch_pandas_all()
print(____)