Riftweaver devait faire évoluer ses environnements Kubernetes pour absorber une charge de joueurs imprévisible, lors du passage de la bêta fermée à l'accès anticipé puis au lancement public. Avec un cluster de production et plusieurs environnements hors production sur AWS EKS, l'ingénieure DevOps Rumby Osei s'appuyait sur Cluster AutoScaler (CAS) pour le scaling des nœuds et sur Horizontal Pod Autoscaler (HPA) pour celui des pods. Lorsque les services ont commencé à subir du throttling, elle s'est tournée vers VPA, mais s'est heurtée à des obstacles : pas de données historiques ni de résultats cohérents. Parmi les principaux points de friction : un throttling CPU fréquent pendant les tests de charge et les sessions de jeu en direct provoquant du lag, un dépannage manuel chronophage avec des métriques contradictoires, et une visibilité limitée des outils existants, dépourvus d'historique et de recommandations actionnables.