Mit der Weiterentwicklung der Kubernetes-Architektur von NOS wuchs auch die Komplexität. Die Teams nutzten Prometheus und Grafana, doch diese Tools lieferten nur Rohmetriken – ohne die Transparenz und Empfehlungen, die für sichere, fundierte Entscheidungen nötig sind, besonders wenn SLAs auf dem Spiel stehen. Ohne klare Orientierung mussten die Engineers raten. Nach mehreren gescheiterten manuellen Right-Sizing-Versuchen, die Abstürze und SLA-Verstöße verursachten, zogen sich die Teams zurück. "Entwickler haben Änderungen nach eigenem Ermessen vorgenommen – und es ging nach hinten los", sagt Joao Soares, Platform Engineering Lead bei NOS. Hinzu kam, dass FinOps-Teams jeden Monat mehrere Tage damit verbrachten, fragmentierte Daten für Reports zusammenzutragen – Probleme zu erkennen oder Budget-Reviews vorzubereiten war entsprechend schwierig.