การ Merge ด้วย PySpark
ในแบบฝึกหัดนี้ เราจะอัปโหลดไฟล์สามไฟล์ลงใน lakehouse ซึ่งแสดงถึงมิติข้อมูลวิดีโอเกมแบบ snowflake ได้แก่ ข้อมูลวิดีโอเกมในไฟล์แรก ข้อมูลแนวเกมในไฟล์ที่สอง และข้อมูลผู้เผยแพร่ในไฟล์ที่สาม จากนั้นจะนำข้อมูลเหล่านี้มารวมเป็นตารางเดียวโดยใช้ PySpark เพื่อดำเนินการ join
หมายเหตุ: หากพบข้อผิดพลาดเกี่ยวกับขีดจำกัด API rate limit มักเกิดจากงาน Fabric ก่อนหน้ายังทำงานไม่เสร็จ สามารถดูงาน Fabric ที่กำลังทำงานอยู่ได้จากหน้า Monitor (อยู่ในเมนูแนวตั้งด้านซ้าย) การยกเลิกงาน Fabric เก่าในหน้า Monitor มักช่วยแก้ปัญหา rate limit error ได้
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
การแปลงและวิเคราะห์ข้อมูลด้วย Microsoft Fabric
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำจริง
เปลี่ยนทฤษฎีให้เป็นการลงมือทำด้วยแบบฝึกหัดเชิงโต้ตอบหนึ่งในของเรา
เริ่มแบบฝึกหัด