开始使用免费开始使用

利用微分区与数据聚簇

您在走廊与首席数据工程师简单交流时得知,Snowflake 正在按 olympic_medals 表中的 year 字段进行数据聚簇,在微分区内对数据排序。您有几条经常对该表执行的查询,希望据此优化,以更好地利用 Snowflake 的微分区和数据聚簇。

sqlalchemy 模块中的 create_engine 函数已导入,并已创建连接对象,存放在变量 conn 中。

本练习是课程的一部分

NoSQL 入门

查看课程

练习说明

  • 更新 Snowflake 查询,仅返回 2000 年及之后举行的比赛的记录。
  • 将 Snowflake 查询结果返回为 pandasDataFrame,并打印结果集。

交互式实操练习

通过完成这段示例代码来试试这个练习。

# Leverage the existing micro-partitions and data clustering
query = """
SELECT
	team,
    year,
    sport,
    event,
    medal
FROM olympic_medals
____ year >= ____;
"""

# Execute the query, print the results
results = conn.cursor().____(query).fetch_pandas_all()
print(____)
编辑并运行代码