เริ่มต้นคลัสเตอร์
โดยทั่วไปคลัสเตอร์จะถูกกำหนดค่าให้ปิดลงและเข้าสู่โหมด IDLE หลังจากไม่มีการใช้งานในช่วงเวลาหนึ่ง เราสามารถใช้ clusters service ของ Databricks SDK เพื่อรันคลัสเตอร์ที่มีอยู่ใน workspace ที่ผ่านการยืนยันตัวตนแล้ว
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
Databricks กับ Python SDK
คำแนะนำการฝึกหัด
- เก็บค่าของตัวแปรสภาพแวดล้อม
DATACAMP_CLUSTER_IDไว้ในตัวแปรชื่อcluster_id - เริ่มต้นคลัสเตอร์โดยใช้ id ที่เก็บไว้ในตัวแปรสภาพแวดล้อม
DATACAMP_CLUSTER_ID
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
w = WorkspaceClient()
# Store value of environment variable as cluster_id
cluster_id = os.____['DATACAMP_CLUSTER_ID']
# Start cluster with id stored in cluster_id variable
try:
w.clusters.start(____=cluster_id).result()
except:
print(f"Cannot start cluster_id={cluster_id} because it is already running")