Tema

Escalado de cargas de cómputo

Auto Scaling groups, políticas de target tracking, step, programado y predictivo, lifecycle hooks e instance refresh, y escalado de ECS, EKS y Lambda.

Escalar parece una sola decisión y son tres. Cuánta capacidad debería haber ahora mismo, cómo se agrega esa capacidad sin que llegue tráfico a una instancia que todavía arranca, y qué pasa cuando la unidad que agregas deja de ser una instancia y pasa a ser una tarea, un pod o un entorno de ejecución. Los síntomas de equivocarse en cada una son distintos, y confundirlos es lo que hace que un incidente de escalado dure una hora en vez de cinco minutos.

Cuatro lecciones, ordenadas de la maquinaria hacia la decisión. La primera arma el Auto Scaling group: los 3 números de capacidad, los health checks que deciden qué se reemplaza, el balance zonal y la política de terminación. La segunda cubre las 5 formas de decidir cuánta capacidad hace falta, con los temporizadores que las frenan. La tercera se mete entre la decisión y la instancia lista: lifecycle hooks, warm pools e instance refresh. La cuarta cambia la unidad de capacidad y muestra qué se conserva y qué no.

Qué cubre este tema

  • Capacidad mínima, deseada y máxima, y cuál de las tres mueve realmente una política de escalado
  • Launch templates contra launch configurations, y por qué Spot mixto, varios tipos de instancia e instance refresh exigen el primero
  • Fuentes de health check del grupo, el health check grace period y su diferencia de valor predeterminado entre consola y CLI
  • Balance zonal, reequilibrio entre zonas de disponibilidad y la política de terminación predeterminada paso a paso
  • Protección contra scale in: qué bloquea y qué no, y los procesos de Auto Scaling que puedes suspender
  • Target tracking, step, simple, programado y predictivo, con la regla de proporcionalidad que descarta métricas como la profundidad de cola
  • Cooldown contra instance warmup, y cómo se resuelven varias políticas apuntando al mismo grupo
  • Estados del ciclo de vida, lifecycle hooks de lanzamiento y terminación, y la asimetría de CONTINUE y ABANDON
  • Warm pools, standby y detach, e instance refresh con sus porcentajes saludables, skip matching y checkpoints
  • Application Auto Scaling, las 2 capas de escalado de ECS, HPA contra Cluster Autoscaler contra Karpenter, y la concurrencia de Lambda

Por qué importa

La habilidad 2.1.1 del SOA-C03 pide configurar y manejar mecanismos de escalado en entornos de cómputo, en plural, y ese plural es la mitad del tema. Las preguntas rara vez piden definir Auto Scaling. Te dan un grupo que no crece, instancias que se relanzan en bucle, o tareas trabadas en PROVISIONING, y te piden la capa donde está el problema.

Ese mismo orden funciona en una guardia. Antes de tocar una política conviene saber si el grupo tocó su techo, si el health check está mirando lo que crees, y si la capa que falla es la que estás mirando.

Lecciones de este tema

  1. 1Grupos de Auto Scaling de EC2Gratis
  2. 2Políticas de escalado a fondo
  3. 3Lifecycle hooks de ASG e instance refresh
  4. 4Escalado de contenedores y serverless