Riftweaver ha incontrato difficoltà nello scalare i propri ambienti Kubernetes per gestire un carico di giocatori imprevedibile durante il passaggio dalla closed beta all'early access e al lancio pubblico. Con un cluster di produzione e diversi ambienti non di produzione su AWS EKS, l'ingegnere DevOps Rumby Osei si affidava a Cluster AutoScaler (CAS) per lo scaling dei nodi e a Horizontal Pod Autoscaler (HPA) per lo scaling dei pod. Quando i servizi hanno iniziato a manifestare problemi di throttling, si è rivolta a VPA, ma ha incontrato ostacoli: non forniva dati storici né risultati coerenti. Tra i principali punti critici: throttling frequente della CPU durante i load test e le sessioni di gioco dal vivo, con conseguente lag; un troubleshooting manuale che richiedeva molto tempo, con metriche contrastanti; e la visibilità limitata offerta dagli strumenti esistenti, privi di dati storici e di raccomandazioni concrete.