← Gestão de Incidentes: coordenar e recuperar
02 / 12 · 40 MIN

Coordenação e responsabilidades

Organiza equipas e alterações para manter uma resposta coerente.

Conceito e mecanismo

Uma resposta coordenada distingue visão global, trabalho técnico e comunicação. O incident commander mantém o estado do incidente e atribui responsabilidades; especialistas investigam e executam ações no âmbito definido; comunicação mantém os interessados informados. Os nomes e combinações de funções variam. Num evento pequeno, uma pessoa pode acumular tarefas se tiver capacidade; quando cresce a carga, é necessário delegar. Ser o especialista mais experiente não implica ser a melhor pessoa para coordenar e executar todas as correções em simultâneo. Se o coordenador for indispensável à resolução técnica, transfere explicitamente a coordenação antes de assumir esse trabalho. A equipa deve saber quem decide prioridades e quem executa cada ação.

Aplicação guiada

Num incidente fictício, rede e middleware propõem alterações sobre a mesma ligação. Regista dependências e sequência para evitar mudanças contraditórias. Investigações independentes podem decorrer em paralelo, mas alterações a estado partilhado exigem coordenação. Usa um canal e registo reconhecidos, com acesso disponível mesmo quando o serviço avariado não funciona. Escala para a função de prevenção adequada, indicando impacto, evidência e tarefa pretendida; não dependas apenas do contacto pessoal de um antigo colega. Se a resposta ficar demasiado extensa, cria frentes de trabalho com responsáveis que reportam ao mesmo coordenador. Define pontos de atualização e liberta participantes que já não são necessários, mantendo a possibilidade de os voltar a chamar.

NA PRÁTICA

Duas equipas não devem alterar o mesmo destino de ligação sem coordenar a sequência.

Armadilhas comuns

Especialista como coordenador obrigatório; alterações autónomas; chamar todos; contacto pessoal como cobertura.

Tópicos relacionados: Triagem e impacto · Diagnóstico e mitigação · Comunicação e evidência

Leva esta ideia contigo

Distribui o trabalho mantendo autoridade, contexto e alterações visíveis.

Criar conta

Referência: Incident roles and scalable responsibility · Incident management practices 2026-09; scoped Google SRE, PagerDuty and Atlassian examples