ระวัง! ข้างหน้าคือดินแดนแห่งความท้าทาย
ก่อนจะเริ่มต้น ขอแจ้งให้ทราบก่อนว่า ยังมีบางสิ่งที่ยังทำไม่ได้ใน Spark จาก R ในตอนนี้ เนื่องจาก interface ของ Spark สำหรับ Scala และ Python นั้นพัฒนามาได้ไกลกว่า
นั่นหมายความว่าคอร์สนี้จะพาคุณก้าวเข้าสู่ดินแดนที่ยังไม่ค่อยมีใครสำรวจมากนัก อาจมีสะดุดบ้างระหว่างทาง จึงควรเตรียมใจรับมือกับสิ่งที่ไม่คุ้นเคยบ้างเป็นครั้งคราว
อีกสิ่งที่ควรทราบคือ ในคอร์สนี้จะรันโค้ดบน Spark mini-cluster ส่วนตัวของคุณบน DataCamp cloud ซึ่งเหมาะสำหรับการเรียนรู้แนวคิดการใช้งาน Spark แต่จะไม่ได้ประสิทธิภาพเท่ากับการใช้ remote cluster บนเซิร์ฟเวอร์ประสิทธิภาพสูง ดังนั้น ตัวอย่างในคอร์สนี้จึงไม่ได้รันเร็วกว่าการใช้ R เพียงอย่างเดียว แต่ทักษะที่ได้เรียนรู้ที่นี่สามารถนำไปใช้วิเคราะห์ชุดข้อมูลขนาดใหญ่ของคุณเองได้จริง
หากต้องการติดตั้ง Spark บนระบบของตัวเอง เพียงติดตั้งแพ็กเกจ sparklyr แล้วเรียก spark_install()
พร้อมจะไปต่อแล้วใช่ไหม?
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
แนะนำ Spark ด้วย sparklyr ใน R
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำจริง
เปลี่ยนทฤษฎีให้เป็นการลงมือทำด้วยแบบฝึกหัดเชิงโต้ตอบหนึ่งในของเรา
เริ่มแบบฝึกหัด