Con l'evolversi dell'architettura Kubernetes di NOS, anche la complessità è cresciuta. I team utilizzavano Prometheus e Grafana, ma questi strumenti fornivano solo metriche grezze, senza la visibilità o le raccomandazioni necessarie per prendere decisioni sicure e consapevoli, soprattutto quando erano in gioco gli SLA. Senza indicazioni chiare, gli Engineers dovevano procedere per tentativi. Dopo diversi tentativi falliti di right-sizing manuale, che avevano causato crash e violazioni degli SLA, i team hanno fatto marcia indietro. "I Developers hanno provato ad apportare modifiche basandosi su ciò che ritenevano sensato, e l'effetto è stato controproducente", ha raccontato Joao Soares, Platform Engineering Lead di NOS. A peggiorare la situazione, i team FinOps impiegavano giorni ogni mese per ricomporre dati frammentati e produrre report, rendendo difficile individuare i problemi o prepararsi alle revisioni di budget.