Cuestionario vinculado a una guía · Medio Nivel

Autoscaling Model Inference on Kubernetes Quiz

Configure model-serving autoscaling signals and account for GPU scheduling, model startup delays, queues and scale-to-zero tradeoffs.

Rutas de guía relacionadasAutoscaling Model Inference Kubernetes
Pregunta 1 de 8

Which signal may represent inference pressure better than CPU alone?