Tema 6: Autoscaling
Base oficial: (The Kubernetes Authors, 2026b, 2026a). Mi versión de trabajo: Autoscaling es un loop de feedback. Necesita métricas, resource requests y un workload que soporte cambios de replicas.
Modelo mental
Autoscaling es un loop de feedback. Necesita métricas, resource requests y un workload que soporte cambios de replicas.
Notas
- Escalamiento horizontal cambia replicas; vertical cambia la forma de recursos.
- Requests malos generan decisiones malas de scaling.
- Scale-to-zero no es el modelo mental default de Kubernetes.
Ángulo homelab
Autoscaling en un homelab es sobre todo educacion salvo que tengas carga variable y capacidad de sobra.
Cómo verificarlo
- Lee el status del objeto antes de cambiar el manifest.
- Revisa events para encontrar el controlador o nodo que realmente se queja.
- Confirma que la fuente oficial abajo todavía coincide con la versión del cluster que corres.
Modos de falla comunes
- Tratar el objeto YAML como el sistema, en vez de verlo como una entrada a un loop de reconciliación.
- Debuggear desde fuera del cluster cuando la falla solo existe dentro de networking o estado de nodo.
- Olvidar que versión de Kubernetes, versión de addon y comportamiento de runtime están conectados.
Fuentes
- Workload Autoscaling - ruta fuente:
content/en/docs/concepts/workloads/autoscaling.md, commit 8cc9e19b8eec8d5cf49eacd66f86a81648edb1a0. - Resource Management for Pods and Containers - ruta fuente:
content/en/docs/concepts/configuration/manage-resources-containers.md, commit 8cc9e19b8eec8d5cf49eacd66f86a81648edb1a0. - La documentación de Kubernetes usa licencia CC BY 4.0; estas notas son comentario original y enlazan a la fuente oficial.
The Kubernetes Authors. (2026a). Resource Management for Pods and Containers. https://kubernetes.io/docs/concepts/configuration/manage-resources-containers/
The Kubernetes Authors. (2026b). Workload Autoscaling. https://kubernetes.io/docs/concepts/workloads/autoscaling/