No início do ano, o CFO (Chief Financial Officer) traçou metas robustas de eficiência e economia unitária para toda a organização. Para Mark Serdze, Diretor de Infraestrutura em Nuvem, e seu time, isso significou agir rápido para otimizar os custos de nuvem. A Trax conseguiu resultados rápidos fora do Kubernetes, mas esbarrou em obstáculos para otimizar com segurança em escala dentro dos clusters. O time começou a otimizar manualmente com as métricas disponíveis, usando o Vertical Pod Autoscaler (VPA), logs de cluster e soluções de monitoramento. Essa abordagem não trazia a clareza necessária e era difícil de escalar com eficiência sem um esforço grande de desenvolvimento. O resultado foram ações pontuais e reativas, com impacto mínimo nas metas. O ferramental existente da Trax também adicionava atrito ao processo de otimização. Mesmo quando o time identificava oportunidades, a aprovação do melhor caminho se baseava em intuição, e não em evidências. Pela falta de visibilidade, alguns passos em falso geraram retrabalho para a engenharia, criaram tensão interna e trouxeram riscos que poderiam comprometer a resiliência dos serviços.