# Estratégias de escalabilidade horizontal e vertical com KServe

Dimensionar corretamente workloads de inferência em IA é vital para garantir desempenho e custo sob controle. KServe permite escalar horizontalmente e verticalmente, integrando recursos nativos do Kubernetes e Knative para responder a picos de tráfego e demandas variáveis.

O conteúdo completo desta lição fica disponível para quem tem conta no Upnetix Learning Center: https://ulc.upnetix.com.br/learn/conta/?aba=cadastro
