Entrar ou criar conta

Upnetix Labs · protocolo de experimento

Protocolo: Qual o impacto do número de pods em um Deployment no tempo de resposta médio de um serviço HTTP no Kubernetes?

Este protocolo responde como o tempo de resposta médio de um serviço HTTP varia conforme o número de pods de um Deployment no Kubernetes. A pessoa vai medir a latência média de requisições HTTP usando k6.

Kubernetes do zero à orquestração produtiva
Ligado ao treinamento Kubernetes do zero à orquestração produtiva
Protocolo, não resultado. Esta página descreve como medir. Execução pela engenharia Upnetix: ainda não realizada. Nenhum valor aqui é resultado de medição da Upnetix; os números que valem são os que você obtém na sua bancada.
Pergunta

Como o tempo de resposta médio de um serviço HTTP varia conforme o número de pods em um Deployment no Kubernetes?

Hipótese

Aumentar o número de pods reduz o tempo de resposta médio do serviço HTTP até um ponto de saturação dos recursos do cluster.

Variáveis

Independentes (o que varia)número de pods no Deployment
Dependentes (o que se mede)tempo de resposta médio (latência) das requisições HTTP
Controladas (o que fica fixo)imagem do container; recursos de CPU/memória por pod; carga de requisições (RPS); configuração de rede; versão do Kubernetes; configuração do serviço (ClusterIP); script de teste k6

Ambiente

Cluster Kubernetes mínimo (por exemplo, 3 nós), serviço exposto via ClusterIP, aplicação HTTP simples (exemplo: nginx), k6 instalado em pod dedicado para geração de carga. Recursos dos pods fixos (exemplo: 100m CPU, 128Mi memória).

Procedimento

  1. Preparar cluster

    Garanta cluster Kubernetes funcional e limpo.

  2. Implantar aplicação

    Aplique um Deployment com a imagem nginx e recursos fixos.

    kubectl apply -f deployment.yaml
  3. Expor serviço

    Crie um Service do tipo ClusterIP para o Deployment.

    kubectl apply -f service.yaml
  4. Configurar pod de teste

    Implante um pod dedicado com k6 instalado para gerar carga.

    kubectl run k6 --image=loadimpact/k6 --restart=Never --command -- sleep 3600
  5. Executar teste para cada valor de pods

    Para cada quantidade de pods (exemplo: 1, 2, 4, 8, 16), atualize o Deployment, aguarde readiness, execute o teste k6 com carga fixa (exemplo: 100 RPS por 60s).

    kubectl scale deployment nginx --replicas=<N>; kubectl exec k6 -- k6 run --vus 100 --duration 60s script.js
  6. Registrar métricas

    Anote o número de pods e o tempo de resposta médio reportado pelo k6.

Planilha de coleta

pods (unidade)latencia_media_ms (milissegundos)
EXEMPLO: 4, 120

Repetições recomendadas: 5. Baixe a planilha vazia em CSV: colunas prontas.

Análise

Calcule média, desvio padrão e mediana do tempo de resposta para cada quantidade de pods. Compare as curvas para identificar o ponto de saturação. Use gráficos para visualizar a relação.

Critérios de decisão

  • Latência média deve diminuir ou estabilizar com o aumento de pods até o limite do cluster.
  • Resultados consistentes entre repetições (desvio padrão baixo).

Fontes de erro e mitigação

  • Variações de carga no cluster podem afetar resultados; execute testes em horários de baixa utilização.
  • Caches de aplicação ou do sistema operacional podem distorcer latências; limpe ou reinicie pods entre repetições.
  • A rede interna do cluster pode ser gargalo; monitore uso de rede.

Referências

  1. fonte oficial · Kubernetes (CNCF) (kubernetes.io)
  2. fonte oficial · Kubernetes (CNCF) (kubernetes.io)
Verificação editorial
Publicado
09/09/2026
Última revisão
09/09/2026
Versão do conteúdo
1.0
Referências
2 oficiais
Revisão técnica
redação e revisão por IA, URLs conferidas na publicação
Status
Atual
Encontrou um erro? Escreva para comercial@upnetix.com.br com o endereço da página. A revisão semestral por IA nunca altera comandos ou configurações sem passar pela fila de revisão.