ПочатиПочніть безкоштовно

Використання мікророзділів і кластеризації даних

Під час короткої розмови в коридорі ваша техлідерка з інженерії даних поділилася, що Snowflake використовує кластеризацію даних, щоб упорядковувати записи всередині мікророзділів за полем year у таблиці olympic_medals. Ви маєте кілька запитів, які регулярно запускаєте до цієї таблиці, і хочете оновити їх, щоб краще використати мікророзділи Snowflake і кластеризацію даних.

Функцію create_engine з модуля sqlalchemy імпортовано, створено об'єкт з'єднання та збережено у змінній conn.

Ця вправа є частиною курсу

Вступ до NoSQL

Переглянути курс

Інструкції до вправи

  • Оновіть запит до Snowflake так, щоб він повертав лише записи про Ігри, які відбулися у 2000 році або пізніше.
  • Поверніть результати запиту Snowflake як DataFrame бібліотеки pandas і виведіть набір результатів.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Leverage the existing micro-partitions and data clustering
query = """
SELECT
	team,
    year,
    sport,
    event,
    medal
FROM olympic_medals
____ year >= ____;
"""

# Execute the query, print the results
results = conn.cursor().____(query).fetch_pandas_all()
print(____)
Редагувати та запускати код