A medida que la arquitectura de Kubernetes de NOS evolucionaba, la complejidad crecía con ella. Los equipos usaban Prometheus y Grafana, pero estas herramientas solo entregaban métricas en bruto, sin la visibilidad ni las recomendaciones necesarias para tomar decisiones seguras y con confianza, sobre todo cuando había SLAs en juego. Sin una guía clara, los Engineers tenían que adivinar. Tras varios intentos fallidos de rightsizing manual que provocaron caídas e incumplimientos de SLA, los equipos dieron un paso atrás. "Los desarrolladores intentaron hacer cambios según lo que les parecía lógico, y salió mal", comentó Joao Soares, líder de Platform Engineering en NOS. A esto se sumaba que los equipos de FinOps dedicaban días cada mes a unir datos fragmentados para armar reportes, lo que dificultaba detectar problemas o prepararse para las revisiones de presupuesto.