ขั้นตอนของ Data Pipeline
หนึ่งใน data pipeline ที่สำคัญต่อธุรกิจของ Sierra Publishing อาศัยข้อมูลจาก Kafka data stream ที่มีความเร็วสูง เราต้องอ่านข้อมูลเข้ามาแล้ว join กับชุดข้อมูลอื่นอีกไม่กี่ชุด

ทีม data engineering ต้องการใช้ Databricks เพื่อเพิ่มประสิทธิภาพของ data pipeline นี้ และช่วยให้ผู้ใช้ปลายทางสามารถอ่านข้อมูลแบบ real-time เพื่อนำไปวิเคราะห์ได้
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
แนวคิด Databricks
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำจริง
เปลี่ยนทฤษฎีให้เป็นการลงมือทำด้วยแบบฝึกหัดเชิงโต้ตอบหนึ่งในของเรา
เริ่มแบบฝึกหัด