Quiz Question 3
You are setting the maximum concurrent requests per instance for a Cloud Run service running AI inference on a GPU. What are some factors to consider when configuring this setting? (Select 2)
Bài tập này là một phần của khóa học
Deploy and Scale AI Models with Cloud Run
Bài tập tương tác thực hành
Biến lý thuyết thành hành động với một trong các bài tập tương tác của chúng tôi
Bắt đầu bài tập