← Balanceamento de carga: tráfego e resiliência
05 / 12 · 40 MIN

Capacidade e falhas em cascata

Calcula margem após falhas e reconhece amplificação de carga.

Conceito e mecanismo

Balanceamento distribui trabalho entre recursos existentes; não cria a capacidade perdida numa falha. Se três instâncias medidas para cem pedidos por segundo servem duzentos e cinquenta, perder uma deixa capacidade de duzentos, com um défice de cinquenta. O exemplo mantém perfil e limites constantes. Em produção, mede a capacidade sob o perfil real, incluindo dependências e latência aceitável. Instâncias saudáveis podem estar coletivamente sem margem suficiente. Contagens iguais também não significam trabalho igual: alguns pedidos consomem mais CPU, memória ou tempo. Observa distribuição por destino e classe de operação antes de concluir que o algoritmo ou os pesos representam bem o custo.

Aplicação guiada

Retries podem multiplicar procura. Três tentativas totais no cliente e até três no proxy por cada tentativa externa permitem nove tentativas ao backend. O enunciado inclui a primeira em cada total, evitando confundir retries adicionais com tentativas. Durante sobrecarga, excluir destinos pode transferir trabalho para menos capacidade e iniciar uma cascata. Avalia admissão, prioridades e recuperação de recursos juntamente com saúde. Filas ilimitadas apenas acumulam trabalho e prazos perdidos. Autoscaling também tem tempo de entrada em serviço: criar pods não prova readiness, aquecimento ou capacidade disponível. Num caso fictício, a mitigação controla trabalho não urgente enquanto se recupera a instância em falta.

NA PRÁTICA

3 × 100 − 100 = 200 pedidos/s disponíveis; procura de 250 deixa défice de 50.

Armadilhas comuns

Saúde como capacidade suficiente; pesos como recursos; retries em camadas como soma; pods criados como prontos.

Tópicos relacionados: Encaminhamento e fronteiras TLS · Algoritmos, afinidade e estado · Health checks e prontidão

Leva esta ideia contigo

Planeia capacidade após falha e limita a amplificação que a recuperação pode causar.

Criar conta

Referência: Google SRE handling overload · DR load balancing 2026-09; selected NGINX, HAProxy 3.2, Kubernetes and AWS ALB behavior