Compreender o conceito
Uma região é uma área geográfica; Availability Zones oferecem isolamento dentro de uma região. Distribuir componentes por zonas pode reduzir impacto de falhas locais, mas a aplicação deve suportar esse desenho. Seleciona região considerando requisitos de dados, latência, serviços disponíveis e operação, não apenas proximidade no mapa.
Aplicar e decidir
Alta disponibilidade e recuperação de desastre têm objetivos relacionados, mas diferentes. Replicação pode propagar uma corrupção; backup deve permitir recuperação de um estado adequado. A existência de várias instâncias não elimina uma dependência única. Analisa a cadeia inteira e demonstra recuperação com os objetivos RTO e RPO acordados.
Aplicação no trabalho
Num serviço com três instâncias web e uma única base, desenha a dependência que todas partilham. Discute o que acontece se a base falhar ou receber uma eliminação lógica. Define com o negócio quanto tempo pode demorar a recuperação e que perda de dados é tolerável. Pede evidência de restauro que corresponda a esses objetivos. A disponibilidade de uma camada não demonstra disponibilidade de toda a cadeia, e replicação pode propagar um erro.
Duas instâncias em zonas distintas continuam dependentes de uma única base de dados sem estratégia de recuperação. O desenho precisa de tratar essa dependência.
Armadilhas comuns
Confundir redundância local com recuperação completa do serviço.
Tópicos relacionados: Escolher computação e dados · Objetos, blocos, ficheiros e rede
Redundância de um componente não prova resiliência de ponta a ponta.
Referência: AWS global infrastructure · CLF-C02