Conceito e mecanismo
Um serviço Swarm declara uma intenção que os managers procuram manter. Num serviço replicado, a intenção inclui o número de tarefas; num serviço global, existe uma tarefa por nó elegível. Elegibilidade depende de condições como disponibilidade e restrições de placement. CPU livre não resolve um label obrigatório ausente. Distingue a execução das tarefas do consenso dos managers: com cinco votantes são necessários três para aceitar alterações. Tarefas existentes podem continuar quando essa maioria se perde, mas isso não demonstra capacidade de recuperar uma nova falha. Mais workers não substituem votantes. Um painel de aplicação verde pode, por isso, coexistir com um problema grave no plano de controlo.
Aplicação guiada
Numa manutenção fictícia APS, começa por inventariar managers, workers, tarefas e contentores independentes. Confirma saúde antes de cada paragem e define um ponto de suspensão quando a margem de quorum desaparece. Drain impede novas tarefas Swarm e conduz ao reagendamento das existentes, mas não esvazia contentores criados com docker run ou compose up. Esses workloads exigem tratamento separado. Para uma tarefa Pending, recolhe a mensagem do scheduler e compara constraints, labels, recursos e disponibilidade antes de reconstruir a imagem. No handover, regista quem decide adiar a janela e que evidência demonstra recuperação. Disponibilidade do negócio e capacidade de gerir o cluster devem aparecer como condições separadas.
Cinco managers, dois indisponíveis: a próxima paragem exige recuperar margem primeiro.
Armadilhas comuns
HTTP como quorum; CPU como elegibilidade; Drain como paragem de tudo; global como réplicas fixas.
Tópicos relacionados: Entregas, rollback e prontidão · Imagens reproduzíveis e registry · Daemon, logs e recuperação
Relaciona estado desejado, nós elegíveis e maioria antes de intervir.
Referência: Swarm administration · DCA Study Guide v1.5 (January2025); current exam listing checked2026-09-30