glossaire

Cluster Autoscaler

Le Cluster Autoscaler ajuste le nombre de nœuds d’un cluster Kubernetes, pas le nombre de pods. Il surveille les pods qui restent bloqués en Pending faute de capacité disponible sur les nœuds existants, et demande au fournisseur cloud (ou à l’infrastructure sous-jacente) de provisionner un nœud supplémentaire pour les accueillir.

Ce qui le distingue du HPA

Le Horizontal Pod Autoscaler décide combien de replicas d’un service doivent tourner. Le Cluster Autoscaler décide combien de machines existent pour les accueillir. Les deux fonctionnent en tandem sans se substituer l’un à l’autre : le HPA peut demander plus de pods que la capacité actuelle ne peut en placer, et c’est précisément ce signal (des pods Pending) qui déclenche le Cluster Autoscaler.

Le scale down retire des nœuds, pas seulement en ajoute

Le Cluster Autoscaler retire aussi des nœuds sous-utilisés, sous condition stricte : un nœud n’est candidat au retrait que si tous ses pods peuvent être replacés ailleurs sans violer de contrainte (un PodDisruptionBudget, une affinité de nœud). Un pod qui ne tolère aucune interruption bloque le retrait du nœud qui l’héberge, même si ce nœud est autrement sous- utilisé.