Announcement

Esta página também está disponível em English, Deutsch, Español, Français, Italiano e 日本語.

Recomendações de pods não removíveis no PerfectScale

Encontre e corrija as configurações que impedem a redução de nós.

By Jacek Wysocki

·

Shipped by

AmitAbrorAndreiMireyaIraJacek

O autoscaler do seu cluster quer remover nós subutilizados. Muitas vezes, ele não consegue. Basta um único pod com um PodDisruptionBudget restritivo, uma anotação do-not-evict, armazenamento local ou uma referência de controller ausente para travar o nó inteiro. O nó continua rodando, praticamente ocioso, e você continua pagando por ele.

Esses bloqueios são difíceis de encontrar. Eles se escondem nos manifestos de workloads espalhados por dezenas de namespaces, e os logs do autoscaler raramente indicam qual pod é o responsável ou quanto ele custa. A maioria das equipes descobre esses casos um a um, geralmente ao investigar por que os custos do cluster pararam de cair depois de um trabalho de right-sizing. A consolidação do Karpenter e o scale-down do Cluster Autoscaler esbarram no mesmo limite: só conseguem remover nós dos quais todos os pods concordam em sair.

O que há de novo

O PerfectScale agora detecta pods não removíveis e mostra exatamente como corrigi-los.

Quando o PerfectScale encontra um pod bloqueando a consolidação de nós, ele gera um diff em YAML comparando a configuração atual com a mudança recomendada. Copie com um clique e aplique ao seu manifesto.

media

Cada recomendação inclui:

  • A configuração exata que impede a remoção do pod, com uma explicação clara da mudança
  • Uma classificação baseada no impacto de custo, para você corrigir primeiro os bloqueios mais caros
  • Um nível de confiança e um nível de risco, para você saber o que é seguro aplicar e o que precisa de revisão
  • Um diff em YAML pronto para copiar

Alguns bloqueios são intencionais. Um pod de banco de dados stateful com um PDB rigoroso pode ser exatamente o que você quer. Clique em Mute for Workload e o PerfectScale oculta esse achado para todos os pods não removíveis do workload, neste scan e nos próximos. As abas Active e Muted mantêm as duas listas visíveis, para que nada suma sem você perceber.

Primeiros passos

No InfraFit, abra o node group em questão e alterne para a visualização Unevictable Pods. Clique em See Recommendations ou no widget Unevictable Pods.

A visualização em si já traz o contexto de cada achado. Cada nó aparece como um card com um treemap de pods, e os pods não removíveis ficam destacados em vermelho. Clique em qualquer pod ou nó para ver todos os detalhes: requests e limits, utilização real, labels e anotações. Os filtros refinam a visualização por taints, namespaces ou outros critérios, e os snapshots vão até um mês atrás, caso você precise comparar com um estado anterior.

Leia a documentação