# Modelos serverless, GPU e inferência distribuída no KServe

O KServe permite servir modelos de IA de forma elástica, aproveitando recursos como serverless com Knative, uso de GPU e inferência distribuída. Entender essas opções é essencial para escalar aplicações de IA em produção, mantendo eficiência e custos sob controle.

O conteúdo completo desta lição fica disponível para quem tem conta no Upnetix Learning Center: https://ulc.upnetix.com.br/learn/conta/?aba=cadastro
