เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

เมื่อเวลาสำคัญ — แต่ไม่มากนัก

คุณได้เรียนรู้แล้วว่า latency ที่ยอมรับได้ของบริการ Machine Learning จะส่งผลต่อการเลือกโหมดการให้บริการที่จะนำไปใช้งานอย่างไร

บางครั้งผู้ใช้รอได้เป็นวัน หรือแม้แต่เป็นสัปดาห์ แต่บางครั้งแค่หนึ่งวินาทีก็มากเกินไปแล้ว

ยิ่ง latency ที่คาดหวังต่ำเท่าไหร่ ความท้าทายด้านวิศวกรรมและต้นทุนของบริการก็ยิ่งสูงขึ้นเท่านั้น ดังนั้นจึงควรหลีกเลี่ยงการออกแบบที่ซับซ้อนเกินความจำเป็น และควรออกแบบบริการ ML ให้ตรงกับสิ่งที่ผู้ใช้ต้องการและยินดีจ่าย

ตัวอย่างเช่น สมมติว่าคุณกำลังสร้างบริการ ML สำหรับวิเคราะห์และสรุปเนื้อหาในไฟล์ .pdf ขนาดใหญ่ หากผู้ใช้บอกว่าต้องการรับผลลัพธ์จากบริการภายใน 5 นาทีหลังส่งคำขอ โหมดการให้บริการที่เหมาะสมที่สุดสำหรับกรณีนี้คือ:

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

MLOps Deployment and Life Cycling

ดูคอร์ส

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำจริง

เปลี่ยนทฤษฎีให้เป็นการลงมือทำด้วยแบบฝึกหัดเชิงโต้ตอบหนึ่งในของเรา

เริ่มแบบฝึกหัด