Tema 6: Autoscaling

Base oficial: (The Kubernetes Authors, 2026b, 2026a). Mi versión de trabajo: Autoscaling es un loop de feedback. Necesita métricas, resource requests y un workload que soporte cambios de replicas.

Modelo mental

Autoscaling es un loop de feedback. Necesita métricas, resource requests y un workload que soporte cambios de replicas.

Notas

  • Escalamiento horizontal cambia replicas; vertical cambia la forma de recursos.
  • Requests malos generan decisiones malas de scaling.
  • Scale-to-zero no es el modelo mental default de Kubernetes.

Ángulo homelab

Autoscaling en un homelab es sobre todo educacion salvo que tengas carga variable y capacidad de sobra.

Cómo verificarlo

  • Lee el status del objeto antes de cambiar el manifest.
  • Revisa events para encontrar el controlador o nodo que realmente se queja.
  • Confirma que la fuente oficial abajo todavía coincide con la versión del cluster que corres.

Modos de falla comunes

  • Tratar el objeto YAML como el sistema, en vez de verlo como una entrada a un loop de reconciliación.
  • Debuggear desde fuera del cluster cuando la falla solo existe dentro de networking o estado de nodo.
  • Olvidar que versión de Kubernetes, versión de addon y comportamiento de runtime están conectados.

Fuentes

  • Workload Autoscaling - ruta fuente: content/en/docs/concepts/workloads/autoscaling.md, commit 8cc9e19b8eec8d5cf49eacd66f86a81648edb1a0.
  • Resource Management for Pods and Containers - ruta fuente: content/en/docs/concepts/configuration/manage-resources-containers.md, commit 8cc9e19b8eec8d5cf49eacd66f86a81648edb1a0.
  • La documentación de Kubernetes usa licencia CC BY 4.0; estas notas son comentario original y enlazan a la fuente oficial.
The Kubernetes Authors. (2026a). Resource Management for Pods and Containers. https://kubernetes.io/docs/concepts/configuration/manage-resources-containers/
The Kubernetes Authors. (2026b). Workload Autoscaling. https://kubernetes.io/docs/concepts/workloads/autoscaling/