เมื่อเวลาสำคัญ — แต่ไม่มากนัก
คุณได้เรียนรู้แล้วว่า latency ที่ยอมรับได้ของบริการ Machine Learning จะส่งผลต่อการเลือกโหมดการให้บริการที่จะนำไปใช้งานอย่างไร
บางครั้งผู้ใช้รอได้เป็นวัน หรือแม้แต่เป็นสัปดาห์ แต่บางครั้งแค่หนึ่งวินาทีก็มากเกินไปแล้ว
ยิ่ง latency ที่คาดหวังต่ำเท่าไหร่ ความท้าทายด้านวิศวกรรมและต้นทุนของบริการก็ยิ่งสูงขึ้นเท่านั้น ดังนั้นจึงควรหลีกเลี่ยงการออกแบบที่ซับซ้อนเกินความจำเป็น และควรออกแบบบริการ ML ให้ตรงกับสิ่งที่ผู้ใช้ต้องการและยินดีจ่าย
ตัวอย่างเช่น สมมติว่าคุณกำลังสร้างบริการ ML สำหรับวิเคราะห์และสรุปเนื้อหาในไฟล์ .pdf ขนาดใหญ่ หากผู้ใช้บอกว่าต้องการรับผลลัพธ์จากบริการภายใน 5 นาทีหลังส่งคำขอ โหมดการให้บริการที่เหมาะสมที่สุดสำหรับกรณีนี้คือ:
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
MLOps Deployment and Life Cycling
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำจริง
เปลี่ยนทฤษฎีให้เป็นการลงมือทำด้วยแบบฝึกหัดเชิงโต้ตอบหนึ่งในของเรา
เริ่มแบบฝึกหัด