Cluster Autoscaler
Le Cluster Autoscaler ajuste le nombre de nœuds d’un cluster Kubernetes,
pas le nombre de pods. Il surveille les pods qui restent bloqués en
Pending faute de capacité disponible sur les nœuds existants, et
demande au fournisseur cloud (ou à l’infrastructure sous-jacente) de
provisionner un nœud supplémentaire pour les accueillir.
Ce qui le distingue du HPA
Le Horizontal Pod Autoscaler
décide combien de replicas d’un service doivent tourner. Le Cluster
Autoscaler décide combien de machines existent pour les accueillir. Les
deux fonctionnent en tandem sans se substituer l’un à l’autre : le HPA
peut demander plus de pods que la capacité actuelle ne peut en placer, et
c’est précisément ce signal (des pods Pending) qui déclenche le Cluster
Autoscaler.
Le scale down retire des nœuds, pas seulement en ajoute
Le Cluster Autoscaler retire aussi des nœuds sous-utilisés, sous condition stricte : un nœud n’est candidat au retrait que si tous ses pods peuvent être replacés ailleurs sans violer de contrainte (un PodDisruptionBudget, une affinité de nœud). Un pod qui ne tolère aucune interruption bloque le retrait du nœud qui l’héberge, même si ce nœud est autrement sous- utilisé.