Glossário
Serverless inference
Execução de modelos de IA sob demanda, escalando para zero quando não há requisições, ativada por Knative no KServe.
Execução de modelos de IA sob demanda, escalando para zero quando não há requisições, ativada por Knative no KServe.
