Conceito e mecanismo
A observabilidade deve distinguir Consul dos serviços que o utilizam. Eleições frequentes, aumento de latência de commit e saturação dos servidores orientam investigação de rede, disco e carga. Métricas de proxies e aplicações mostram resultados do caminho de negócio. Um dashboard de controlo saudável não elimina HTTP 503 na aplicação. Compara sinais com uma linha de base e mudanças recentes antes de atribuir causa. Monitoriza também validade de certificados, capacidade e falhas de sincronização. Um alerta só é útil se existir responsável e ação adequada. Leituras stale podem continuar sem líder, pelo que uma resposta de leitura não demonstra capacidade atual de confirmar novas escritas.
Aplicação guiada
Snapshot guarda estado dos servidores, incluindo catálogo, KV, prepared queries, sessões e ACL. Não guarda automaticamente as bases de dados das aplicações registadas. Protege o ficheiro porque pode conter material de acesso. Para ensaiar recuperação, a documentação orienta restore para um cluster novo com a mesma versão e alerta para a sensibilidade da operação Raft. Planeia acesso, dependências e validação posterior dos consumidores. Num handover fictício, um ficheiro de backup não prova RTO de trinta minutos. RUN deve executar o procedimento, medir tempo total e demonstrar serviço recuperado. Guarda evidência, lacunas e decisão de aceitação. Evita transformar restore numa tentativa rotineira para qualquer erro DNS ou falha de health check.
Snapshot presente, restore nunca ensaiado: há backup, mas o prazo de recuperação continua por demonstrar.
Armadilhas comuns
UI saudável como serviço recuperado; leitura stale como commit; snapshot como dados de todas as aplicações.
Tópicos relacionados: Descoberta, arquitetura e quorum · Deployment e bootstrap · Registo, health checks e DNS
Mede recuperação até ao consumidor e separa sinais por camada.
Referência: Snapshot save and state coverage · Historical Consul Associate (003), retired 2026-07-15; technical references inspected 2026-09-30