Upnetix Labs · protocolo de experimento
Protocolo: Qual o impacto do intervalo de scraping do Prometheus na latência de coleta de métricas em sensores IoT simulados?
Este protocolo investiga como diferentes intervalos de scraping do Prometheus afetam a latência na coleta de métricas de sensores IoT simulados. O objetivo é medir a latência percebida e identificar o ponto de equilíbrio entre frequência de coleta e sobrecarga.

Como o ajuste do intervalo de scraping do Prometheus afeta a latência de coleta de métricas em sensores IoT simulados?
Hipótese
Intervalos de scraping menores reduzem a latência média de coleta, mas aumentam a sobrecarga no Prometheus e nos sensores.
Variáveis
| Independentes (o que varia) | intervalo de scraping do Prometheus (em segundos) |
|---|---|
| Dependentes (o que se mede) | latência de coleta (ms); uso de CPU do Prometheus (%); uso de CPU do sensor simulado (%) |
| Controladas (o que fica fixo) | hardware do servidor Prometheus; quantidade de sensores simulados; rede local sem variação de latência; versão do Prometheus |
Ambiente
Servidor Prometheus em máquina dedicada (Linux), sensores IoT simulados via prometheus-community/prometheus-pushgateway, monitoramento de uso de CPU via node_exporter, análise de latência via timestamps nas métricas. Ferramentas: Prometheus, Pushgateway, node_exporter.
Procedimento
- Preparar ambiente
Instale Prometheus, Pushgateway e node_exporter conforme documentação oficial.
- Configurar sensores simulados
Implemente script que envia métricas para o Pushgateway a cada 5 segundos.
python sensor_simulator.py - Configurar Prometheus
Ajuste o scrape_interval no prometheus.yml para o valor de teste.
vim /etc/prometheus/prometheus.yml - Reiniciar Prometheus
Reinicie o serviço após cada alteração de scrape_interval.
systemctl restart prometheus - Coletar métricas
Durante 10 minutos por configuração, registre latência (timestamp do envio menos timestamp da coleta), uso de CPU do Prometheus e dos sensores.
- Repetir
Repita para cada valor de scrape_interval (por exemplo, 1s, 5s, 10s, 30s, 60s).
Planilha de coleta
| scrape_interval (s) | latencia_ms (ms) | cpu_prometheus_pct (%) | cpu_sensor_pct (%) | timestamp (UTC) |
|---|---|---|---|---|
| EXEMPLO: 5, 120, 8.5, 2.1, 2024-06-15T14:23:00Z | ||||
Repetições recomendadas: 5. Baixe a planilha vazia em CSV: colunas prontas.
Análise
Calcule média, mediana e desvio padrão da latência para cada scrape_interval. Compare uso de CPU. Identifique o menor intervalo possível antes do aumento significativo de latência ou uso de CPU.
Critérios de decisão
- Latência média aceitável (por exemplo, <200ms, conforme requisitos do caso de uso)
- Uso de CPU do Prometheus e sensores não ultrapassa 70%
- Consistência dos resultados entre repetições
Fontes de erro e mitigação
- Variação de carga na máquina pode afetar CPU; mitigar isolando o ambiente.
- Relógios dos servidores desalinhados podem distorcer latência; sincronize via NTP.
- Rede local deve ser estável para não interferir nos resultados.
- Publicado
- 09/09/2026
- Última revisão
- 09/09/2026
- Versão do conteúdo
- 1.0
- Referências
- 0 oficiais
- Revisão técnica
- redação e revisão por IA, URLs conferidas na publicação
- Status
- Atual
