Refonte des coûts et de la fiabilité Kubernetes
17 400 $/mois
économisés
61 %
d'utilisation des nodes
0
incident OOM
Un cluster EKS de 40 nodes tournait sur des node groups statiques choisis à la main, sans aucune discipline d'autoscaling, et les pods se faisaient OOMKill à chaque pic de trafic. La facture de calcul montait pendant que la fiabilité empirait. Redimensionnement de chaque workload à partir de données Prometheus réelles, puis remplacement des node groups statiques et du Cluster Autoscaler par Karpenter pour un provisionnement juste-à-temps et bin-packé. Ajout de PodDisruptionBudgets pour que la consolidation ne fasse jamais tomber un service sous son nombre minimal de répliques.
Node groups statiques m5.2xlarge pour chaque workload→Nodes provisionnés par Karpenter, dimensionnés par pod en attente
24 % d'utilisation moyenne des requests CPU→61 % d'utilisation moyenne des requests CPU
OOM kills à chaque pic de trafic→Zéro incident OOM en 90 jours