EC2 Auto Scaling
Amazon EC2 Auto Scaling
Ajusta automaticamente o número de instâncias EC2.
O que é
Mantém um grupo de instâncias EC2 dentro de limites mínimo, desejado e máximo, adicionando ou removendo instâncias conforme a demanda ou a saúde delas.
Quando usar
- A demanda da aplicação varia ao longo do dia, da semana ou por campanha.
- Você quer substituir automaticamente instâncias que falharam no health check.
- Precisa distribuir instâncias entre várias Zonas de Disponibilidade.
Como funciona
- Um Auto Scaling group usa um launch template e opera sobre uma ou mais subnets/AZs.
- Políticas de escalonamento reagem a métricas do CloudWatch (ex.: CPU média) ou a uma agenda.
- Normalmente trabalha junto de um Elastic Load Balancing, que distribui o tráfego.
Como aparece na prova
- É o serviço da palavra-chave elasticidade: capacidade acompanha a demanda automaticamente.
- Escalar horizontalmente (scale out) = mais instâncias. Escalar verticalmente (scale up) = instância maior: isso o Auto Scaling não faz.
- Contribui para alta disponibilidade quando o grupo abrange múltiplas AZs.
Não confunda com
O ELB distribui tráfego; o Auto Scaling muda a quantidade de instâncias.
AWS Auto Scaling é o plano unificado para vários serviços; o EC2 Auto Scaling cuida só de instâncias EC2.
Arquitetura simples
Questões relacionadas
A capacidade de adicionar e remover recursos automaticamente conforme a demanda varia é chamada de:
Ver resposta comentada
Resposta: Elasticidade
Elasticidade é acompanhar a demanda em tempo real, provisionando quando ela cresce e liberando quando ela cai, evitando pagar por capacidade ociosa.
Qual serviço monitora métricas como uso de CPU e pode disparar automaticamente uma ação de escalonamento?
Ver resposta comentada
Resposta: Amazon CloudWatch
O CloudWatch coleta métricas e dispara alarmes; esses alarmes são o gatilho típico das políticas de Auto Scaling.