Glossário

Serverless inference

Execução de modelos de IA sob demanda, escalando para zero quando não há requisições, ativada por Knative no KServe.

Execução de modelos de IA sob demanda, escalando para zero quando não há requisições, ativada por Knative no KServe.

Onde isto aparece