Guide-linked quiz · Medium Level
Autoscaling Model Inference on Kubernetes Quiz
Configure model-serving autoscaling signals and account for GPU scheduling, model startup delays, queues and scale-to-zero tradeoffs.
Question 1 of 8
Which signal may represent inference pressure better than CPU alone?
Keep testing yourself
More quizzes picked for your level.