Bắt đầu ngayBắt đầu miễn phí

Tận dụng micro-partitions và phân cụm dữ liệu

Trong một cuộc trao đổi nhanh ở hành lang với Lead Data Engineer, cô ấy chia sẻ rằng Snowflake đang dùng phân cụm dữ liệu để sắp xếp dữ liệu trong các micro-partition theo trường year trong bảng olympic_medals. Bạn có vài truy vấn thường xuyên chạy trên bảng này và muốn cập nhật để tận dụng tốt hơn micro-partitions và phân cụm dữ liệu của Snowflake.

Hàm create_engine từ mô-đun sqlalchemy đã được nhập, và một đối tượng kết nối đã được tạo rồi lưu trong biến conn.

Bài tập này là một phần của khóa học

Giới thiệu về NoSQL

Xem khóa học

Hướng dẫn bài tập

  • Cập nhật truy vấn Snowflake để chỉ trả về các bản ghi cho những kỳ thi đấu diễn ra từ năm 2000 trở đi.
  • Trả về kết quả truy vấn Snowflake dưới dạng DataFrame của pandas, và in tập kết quả.

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Leverage the existing micro-partitions and data clustering
query = """
SELECT
	team,
    year,
    sport,
    event,
    medal
FROM olympic_medals
____ year >= ____;
"""

# Execute the query, print the results
results = conn.cursor().____(query).fetch_pandas_all()
print(____)
Chỉnh sửa và Chạy Mã