À medida que a arquitetura Kubernetes da NOS evoluía, a complexidade crescia junto. As equipes usavam Prometheus e Grafana, mas essas ferramentas forneciam apenas métricas brutas, sem a visibilidade ou as recomendações necessárias para decisões seguras e confiantes — principalmente quando os SLAs estavam em jogo. Sem orientação clara, os engenheiros precisavam adivinhar. Depois de várias tentativas fracassadas de rightsizing manual que causaram quedas e violações de SLA, as equipes recuaram. 'Os desenvolvedores tentavam fazer mudanças com base no que achavam que fazia sentido, e o tiro saía pela culatra', contou Joao Soares, líder de Platform Engineering da NOS. Para piorar, as equipes de FinOps passavam dias todo mês juntando dados fragmentados para montar relatórios, o que dificultava identificar problemas ou se preparar para revisões de orçamento.