← Monitorização e Observabilidade: medir e investigar
01 / 12 · 40 MIN

Sinais e resultados do serviço

Relaciona sinais técnicos com operações úteis para o utilizador.

Conceito e mecanismo

Uma plataforma de observabilidade deve ajudar a explicar o comportamento do serviço. Métricas agregam medições ao longo do tempo; logs registam acontecimentos; traces relacionam operações num caminho distribuído. Cada sinal tem limites. CPU normal não demonstra que uma transferência foi aceite e uma linha de log não representa automaticamente todos os pedidos. OpenTelemetry fornece mecanismos para instrumentar, recolher, processar e exportar telemetria; a sua utilização não dispensa escolher armazenamento, consultas e visualização apropriados. Começa por definir uma operação relevante, o resultado esperado e a população medida. Num serviço fictício de consulta de posições, distingue pedidos válidos, falhas técnicas e rejeições esperadas por regras de negócio.

Aplicação guiada

Usa latência, tráfego, erros e saturação para construir uma primeira leitura. Se as respostas de erro forem muito rápidas, a média global de latência pode melhorar durante uma falha; separa resultados e observa a cauda da distribuição. Calcula proporções com denominadores explícitos: 60 erros em 12 000 pedidos elegíveis representam 0,5%. Não faças a média simples de percentagens de instâncias que recebem volumes diferentes. Combina a perspetiva externa, que testa o serviço, com sinais internos que ajudam a localizar causas. Num batch, o processo vivo é insuficiente: interessa saber quando terminou com sucesso e se os dados esperados foram produzidos. Regista no dashboard a janela, a unidade e o significado de cada sinal.

NA PRÁTICA

Média de latência inferior com mais HTTP 500 rápidos pode indicar degradação.

Armadilhas comuns

CPU como experiência; média como cauda; rejeição esperada como falha técnica; percentagens sem denominador.

Tópicos relacionados: Métricas e consultas · Traces e contexto · Instrumentação e proteção

Leva esta ideia contigo

Define o resultado útil antes de escolher o indicador.

Criar conta

Referência: User symptoms golden signals and actionable monitoring · Observability 2026-09; selected OpenTelemetry, Prometheus and Dynatrace Classic concepts