利用微分区与数据聚簇
您在走廊与首席数据工程师简单交流时得知,Snowflake 正在按 olympic_medals 表中的 year 字段进行数据聚簇,在微分区内对数据排序。您有几条经常对该表执行的查询,希望据此优化,以更好地利用 Snowflake 的微分区和数据聚簇。
sqlalchemy 模块中的 create_engine 函数已导入,并已创建连接对象,存放在变量 conn 中。
本练习是课程的一部分
NoSQL 入门
练习说明
- 更新 Snowflake 查询,仅返回 2000 年及之后举行的比赛的记录。
- 将 Snowflake 查询结果返回为
pandas的DataFrame,并打印结果集。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Leverage the existing micro-partitions and data clustering
query = """
SELECT
team,
year,
sport,
event,
medal
FROM olympic_medals
____ year >= ____;
"""
# Execute the query, print the results
results = conn.cursor().____(query).fetch_pandas_all()
print(____)