Upnetix Labs · protocolo de experimento
Protocolo: Qual o impacto do número de pods em um Deployment no tempo de resposta médio de um serviço HTTP no Kubernetes?
Este protocolo responde como o tempo de resposta médio de um serviço HTTP varia conforme o número de pods de um Deployment no Kubernetes. A pessoa vai medir a latência média de requisições HTTP usando k6.

Como o tempo de resposta médio de um serviço HTTP varia conforme o número de pods em um Deployment no Kubernetes?
Hipótese
Aumentar o número de pods reduz o tempo de resposta médio do serviço HTTP até um ponto de saturação dos recursos do cluster.
Variáveis
| Independentes (o que varia) | número de pods no Deployment |
|---|---|
| Dependentes (o que se mede) | tempo de resposta médio (latência) das requisições HTTP |
| Controladas (o que fica fixo) | imagem do container; recursos de CPU/memória por pod; carga de requisições (RPS); configuração de rede; versão do Kubernetes; configuração do serviço (ClusterIP); script de teste k6 |
Ambiente
Cluster Kubernetes mínimo (por exemplo, 3 nós), serviço exposto via ClusterIP, aplicação HTTP simples (exemplo: nginx), k6 instalado em pod dedicado para geração de carga. Recursos dos pods fixos (exemplo: 100m CPU, 128Mi memória).
Procedimento
- Preparar cluster
Garanta cluster Kubernetes funcional e limpo.
- Implantar aplicação
Aplique um Deployment com a imagem nginx e recursos fixos.
kubectl apply -f deployment.yaml - Expor serviço
Crie um Service do tipo ClusterIP para o Deployment.
kubectl apply -f service.yaml - Configurar pod de teste
Implante um pod dedicado com k6 instalado para gerar carga.
kubectl run k6 --image=loadimpact/k6 --restart=Never --command -- sleep 3600 - Executar teste para cada valor de pods
Para cada quantidade de pods (exemplo: 1, 2, 4, 8, 16), atualize o Deployment, aguarde readiness, execute o teste k6 com carga fixa (exemplo: 100 RPS por 60s).
kubectl scale deployment nginx --replicas=<N>; kubectl exec k6 -- k6 run --vus 100 --duration 60s script.js - Registrar métricas
Anote o número de pods e o tempo de resposta médio reportado pelo k6.
Planilha de coleta
| pods (unidade) | latencia_media_ms (milissegundos) |
|---|---|
| EXEMPLO: 4, 120 | |
Repetições recomendadas: 5. Baixe a planilha vazia em CSV: colunas prontas.
Análise
Calcule média, desvio padrão e mediana do tempo de resposta para cada quantidade de pods. Compare as curvas para identificar o ponto de saturação. Use gráficos para visualizar a relação.
Critérios de decisão
- Latência média deve diminuir ou estabilizar com o aumento de pods até o limite do cluster.
- Resultados consistentes entre repetições (desvio padrão baixo).
Fontes de erro e mitigação
- Variações de carga no cluster podem afetar resultados; execute testes em horários de baixa utilização.
- Caches de aplicação ou do sistema operacional podem distorcer latências; limpe ou reinicie pods entre repetições.
- A rede interna do cluster pode ser gargalo; monitore uso de rede.
Referências
- fonte oficial · Kubernetes (CNCF) (kubernetes.io)
- fonte oficial · Kubernetes (CNCF) (kubernetes.io)
- Publicado
- 09/09/2026
- Última revisão
- 09/09/2026
- Versão do conteúdo
- 1.0
- Referências
- 2 oficiais
- Revisão técnica
- redação e revisão por IA, URLs conferidas na publicação
- Status
- Atual
