Spark, Hadoop และ Hive
ในวิดีโอก่อนหน้านี้ คุณได้พบกับโปรเจกต์โอเพนซอร์สหลายตัว ไม่ว่าจะเป็น Hadoop, Hive และ PySpark ซึ่งอาจทำให้สับสนได้ง่าย
โปรเจกต์เหล่านี้มีบางอย่างที่เหมือนกัน: ทั้งหมดอยู่ภายใต้การดูแลของ Apache Software Foundation และถูกใช้งานสำหรับการประมวลผลแบบขนานขนาดใหญ่ แล้วความแตกต่างระหว่างกันคืออะไร?
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
Data Engineering เบื้องต้น
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำจริง
เปลี่ยนทฤษฎีให้เป็นการลงมือทำด้วยแบบฝึกหัดเชิงโต้ตอบหนึ่งในของเรา
เริ่มแบบฝึกหัด