Conceito e mecanismo
Zone redundancy protege contra falhas de zona dentro de uma região; continuidade perante perda regional exige outro âmbito de proteção. Failover groups usam replicação geográfica e listeners para acompanhar os papéis. Um planned failover e um forced failover têm condições e riscos diferentes. Se o primary está inacessível, transações ainda não replicadas podem perder-se na promoção da secondary. Online não significa totalmente sincronizado. Usa o listener read-write para escritas e valida DNS, reconexão e retries seguros. Sessões existentes não se tornam magicamente transações concluídas no novo destino. As políticas geridas pelo cliente e pela Microsoft também têm expectativas próprias; não prometas o mesmo RTO em qualquer configuração.
Aplicação guiada
Num desenho fictício em VMs, distingue FCI, que protege a instância com storage partilhado, de availability groups, que usam réplicas de bases com cópias próprias. Log shipping envia e restaura backups de log para recuperação, com operação própria. Nenhum destes nomes substitui avaliação de regiões, rede, quorum, identidade e jobs. No ensaio DR, cronometra o retorno da aplicação, não só a abertura da base. Se DNS ou chaves acrescentarem uma hora, esse tempo faz parte do resultado de negócio. O handover para APS precisa de runbook, alarmes, critérios de escalada, evidência do ensaio, owners e reconciliação após eventual perda. Regista riscos que ainda impedem autonomia do RUN.
Base aberta em 15 minutos + aplicação operacional 60 minutos depois = 75 minutos até serviço útil, neste caso fictício.
Armadilhas comuns
Zona como região; Online como sincronizado; listener como transação sem falha; RTO só da base.
Tópicos relacionados: Plataforma, capacidade e migração · Identidade, rede e cifragem · Dados sensíveis e evidência
A recuperação termina quando o serviço cumpre os critérios acordados.
Referência: Failover groups and listener endpoints · DP-300 English objectives effective 2026-04-24