НачатьНачать бесплатно

Использование микроразделов и кластеризации данных

Во время короткого разговора в коридоре ваш ведущий инженер по данным сообщила вам, что Snowflake использует кластеризацию данных для сортировки записей внутри микроразделов по полю year в таблице olympic_medals. У вас есть несколько запросов, которые вы регулярно выполняете к этой таблице, — и вы хотите обновить их, чтобы лучше задействовать возможности микроразделов и кластеризации данных в Snowflake.

Функция create_engine из модуля sqlalchemy уже импортирована, а объект подключения создан и сохранён в переменной conn.

Это упражнение является частью курса

Введение в NoSQL

Посмотреть курс

Инструкции к упражнению

  • Обновите запрос к Snowflake так, чтобы он возвращал только записи об играх, проходивших в 2000 году и позднее.
  • Получите результаты запроса к Snowflake в виде DataFrame библиотеки pandas и выведите результирующий набор данных.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Leverage the existing micro-partitions and data clustering
query = """
SELECT
	team,
    year,
    sport,
    event,
    medal
FROM olympic_medals
____ year >= ____;
"""

# Execute the query, print the results
results = conn.cursor().____(query).fetch_pandas_all()
print(____)
Редактировать и запускать код