Conceito e mecanismo
A coordenação de um incidente precisa de uma pessoa identificada, papéis compreendidos e um local reconhecido para acompanhar decisões. A escala da resposta pode exigir liderança operacional, comunicação, registo e subequipas especializadas. Quem coordena acompanha o conjunto e remove bloqueios; quem executa precisa de contexto e espaço para trabalhar. Uma tarefa útil identifica uma pessoa, uma ação, o resultado esperado e o momento de retorno. Confirma que o pedido foi entendido. Um registo vivo deve destacar impacto atual, ações em curso, responsáveis, decisões, hipóteses e próximos momentos de atualização. Guarda a sequência de alterações para evitar intervenções incompatíveis ou repetidas.
Aplicação guiada
Num incidente fictício de middleware, rede e aplicação propõem alterações simultâneas. Pede aos especialistas que apresentem objetivo, risco e evidência esperada, depois combina uma sequência coerente com a liderança operacional. Se forem necessárias investigações paralelas, atribui um responsável por cada frente e define quando regressa informação à coordenação. Paralelismo de análise não implica autorização implícita para mudar produção. Se um gestor sénior entrar na chamada, atualiza-o pelo canal adequado e mantém explícito quem coordena. A antiguidade hierárquica não constitui passagem de responsabilidade. Se a mudança de liderança fizer sentido, realiza uma passagem reconhecida por todos, dentro do mandato local.
Uma tarefa sem confirmação pode continuar sem execução, mesmo que tenha sido dita em voz alta.
Armadilhas comuns
Pedidos a alguém sem nome; alterações paralelas; comando pelo cargo; registo desatualizado.
Tópicos relacionados: Declaração, impacto e prioridade · Comunicação e incerteza · Decisões de mitigação e evidência
Delega com responsável e retorno, mantendo uma visão partilhada do incidente.
Referência: Managing Incidents · Google SRE incident guidance; PagerDuty contextual incident model; NIST SP 800-61 Rev. 3 April 2025; editorial review 2026-10-01