PerfectScalePerfectScale

Questa pagina è disponibile anche in English, Deutsch, Español, Français, 日本語 e Português.

Come PerfectScale permette a un team DevOps di una sola persona di scalare Riftweaver

Lo studio di gaming Riftweaver ha ridotto il throttling della CPU del 59% e ha messo un singolo ingegnere DevOps nelle condizioni di scalare Kubernetes in tutta sicurezza

PerfectScale
Riftweaver

The Challenge

Riftweaver ha incontrato difficoltà nello scalare i propri ambienti Kubernetes per gestire un carico di giocatori imprevedibile durante il passaggio dalla closed beta all'early access e al lancio pubblico. Con un cluster di produzione e diversi ambienti non di produzione su AWS EKS, l'ingegnere DevOps Rumby Osei si affidava a Cluster AutoScaler (CAS) per lo scaling dei nodi e a Horizontal Pod Autoscaler (HPA) per lo scaling dei pod. Quando i servizi hanno iniziato a manifestare problemi di throttling, si è rivolta a VPA, ma ha incontrato ostacoli: non forniva dati storici né risultati coerenti. Tra i principali punti critici: throttling frequente della CPU durante i load test e le sessioni di gioco dal vivo, con conseguente lag; un troubleshooting manuale che richiedeva molto tempo, con metriche contrastanti; e la visibilità limitata offerta dagli strumenti esistenti, privi di dati storici e di raccomandazioni concrete.

The Solution

PerfectScale è diventato parte integrante della strategia infrastrutturale di Riftweaver. Osei lo utilizza per ridurre il throttling della CPU identificando i workloads ad alto rischio e ottenendo raccomandazioni mirate per la regolazione delle risorse CPU; semplificare l'allocazione delle risorse grazie agli insight su nodi e workloads sottoutilizzati, ottimizzando sia il posizionamento dei pod sia la scelta dei nodi; e migliorare la resilienza dando priorità alle modifiche in base ai profili di rischio di PerfectScale, riducendo al minimo problemi come le chiamate API perse o duplicate. L'interfaccia di PerfectScale, i profili di rischio e funzionalità uniche come il tracciamento della CO2 hanno dato a Osei piena fiducia nelle raccomandazioni.

Results

  • Ridotto il throttling della CPU di quasi il 59% su sei API critiche
  • Migliorata l'esperienza utente risolvendo i colli di bottiglia nelle prestazioni e riducendo il lag
  • Consentito a un singolo ingegnere DevOps di gestire lo scaling in modo proattivo con il minimo sforzo manuale
  • Semplificate le operazioni per un team DevOps di una sola persona
  • Ottenuta un'ottimizzazione di livello enterprise a costo zero grazie al Community Package di PerfectScale
  • Preparata l'infrastruttura alla crescita futura, con l'espansione di Riftweaver verso nuove piattaforme e nuovi utenti

PerfectScale ha cambiato le regole del gioco. Gli insight non solo hanno risolto i problemi immediati, ma ci hanno anche preparato alla crescita futura, man mano che ci espandiamo verso nuove piattaforme e nuovi utenti.

Rumby Osei, Senior DevOps Engineer di Riftweaver

Chi è Riftweaver?

Riftweaver è uno studio di gaming innovativo che nell'ultimo anno ha fatto passi da gigante. Dal lancio del suo gioco di punta all'arrivo del gameplay su piattaforme come Steam e iPad, lo studio ha superato gli 80.000 download. Con un team di appena 15 dipendenti, l'infrastruttura backend di Riftweaver è gestita da un unico ingegnere DevOps, Rumby Osei, che garantisce che l'infrastruttura del gioco scali in modo efficiente offrendo al tempo stesso un'esperienza impeccabile a una base di giocatori in continua crescita.

La sfida

"Quando sono entrata in Riftweaver, il gioco non scalava e non reggeva carichi da ambiente di produzione. Il mio compito era portarci a quel livello", racconta Osei. Riftweaver ha incontrato difficoltà nello scalare i propri ambienti Kubernetes per gestire un carico di giocatori imprevedibile durante il passaggio dalla closed beta all'early access e al lancio pubblico. Con un'infrastruttura su AWS EKS basata su Cluster AutoScaler e HPA, il team ha riscontrato problemi di throttling. Quando Osei si è rivolta a VPA, ha incontrato ostacoli: "VPA non forniva dati storici né mi permetteva di ottenere risultati coerenti. Non potevo tornare indietro e vedere cosa fosse cambiato nel tempo. Ho persino dovuto scrivere uno script per scaricare tutti i VPA di ogni deployment solo per confrontare i dati." Tra i principali punti critici: throttling frequente della CPU durante il gameplay, un troubleshooting manuale che richiedeva molto tempo e la visibilità limitata offerta dagli strumenti esistenti.

Perché PerfectScale?

Rumby Osei ha iniziato a cercare una soluzione che la aiutasse a prendere decisioni di right-sizing più basate sui dati, ridurre i colli di bottiglia nelle prestazioni e ottenere insight concreti sull'utilizzo delle risorse. Dopo un confronto con il team di PerfectScale, Osei ne ha intuito il potenziale per colmare il divario tra le previsioni dei load test e il comportamento reale degli utenti, migliorando così la resilienza dei suoi workloads. "L'interfaccia e i profili di rischio di PerfectScale mi hanno dato fiducia nelle raccomandazioni. Ha inoltre introdotto funzionalità che non avevo mai visto prima, come il monitoraggio dell'impatto ambientale con il tracciamento della CO2."

La soluzione: scaling e prestazioni ottimizzati con PerfectScale

PerfectScale è ormai parte integrante della strategia infrastrutturale di Riftweaver. Osei lo utilizza per ridurre il throttling della CPU identificando i workloads ad alto rischio e ottenendo raccomandazioni mirate per la regolazione delle risorse CPU. Gli insight su nodi e workloads sottoutilizzati le hanno permesso di ottimizzare sia il posizionamento dei pod sia la scelta dei nodi, riducendo gli sprechi e migliorando l'efficienza. Dando priorità alle modifiche in base ai profili di rischio di PerfectScale, Riftweaver riduce al minimo problemi come le chiamate API perse o duplicate che in passato frustravano gli utenti.

I risultati: gameplay più fluido ed efficienza operativa

PerfectScale sta aiutando Riftweaver a scalare per rispondere a una domanda in crescita, riducendo al contempo il carico operativo. Tra i risultati principali: una riduzione del 59% del throttling della CPU su sei API critiche, per un gameplay più fluido; un'esperienza utente migliore, con meno interruzioni anche nei momenti di picco; operazioni semplificate che consentono a un team DevOps di una sola persona di gestire scaling e resilienza in modo proattivo con il minimo sforzo manuale; e uno scaling economicamente sostenibile grazie al Community Package di PerfectScale, che permette al team di ottimizzare l'infrastruttura senza ulteriori oneri economici.

Perché PerfectScale funziona per Riftweaver

L'interfaccia intuitiva di PerfectScale, le analisi solide e le raccomandazioni concrete lo hanno reso uno strumento essenziale per il team piccolo ma dinamico di Riftweaver. Funzionalità come il tracciamento dell'impatto ambientale e la visibilità sull'HPA rispecchiano inoltre l'approccio lungimirante dello studio alla gestione dell'infrastruttura. Integrando PerfectScale, Riftweaver ha ottimizzato il suo ambiente Kubernetes, garantendo scalabilità, affidabilità e un'esperienza di gioco superiore. Con la continua crescita dello studio, PerfectScale resta un partner importante nel suo percorso per offrire un gameplay entusiasmante e senza lag ai giocatori di tutto il mondo.

Scopra come PerfectScale migliora l'efficienza di Kubernetes

Scopra come PerfectScale aiuta i team a fare right-sizing dei cluster, ridurre gli sprechi e migliorare le prestazioni senza tuning manuale.

More customer stories

PicnicAI

PicnicAI automatizza l'85-90% dei workload Kubernetes e migliora l'affidabilità con PerfectScale by DoiT

85–90%
dei workload applicativi ora coperti dal resizing automatico
50%
riduzione approssimativa del tempo che il team infrastruttura dedica all'infrastruttura
Stefanini

Stefanini taglia del 26% i costi di compute Kubernetes con PerfectScale by DoiT

26%
Riduzione dei costi di compute Kubernetes
>60%
Riduzione dei costi di infrastruttura nell'ultimo anno
OneFootball

PerfectScale by DoiT aiuta OneFootball a ottimizzare Kubernetes per il traffico calcistico globale su larga scala

25%
di riduzione dei costi dell'infrastruttura Kubernetes
80%
di riduzione del lavoro di engineering dedicato all'ottimizzazione dei costi e al tuning della resilienza su Kubernetes
Luma Health

Luma Health taglia del 40% i costi di EKS e libera migliaia di ore di engineering all'anno

90%
Tempo in meno sul rightsizing manuale di Kubernetes
40%
Riduzione dei costi di Amazon EKS
+1,700h/year
Ore di engineering reindirizzate ad affidabilità e prestazioni
PlayHQ

PlayHQ ottimizza i costi Kubernetes multi-tenant

40%
Riduzione dei costi Kubernetes non-production
40%
Riduzione dei costi K8s non-production
20%
Riduzione dei costi K8s in produzione
SNCF

Come SNCF ha ridotto gli sprechi su K8s aumentando l'affidabilità su larga scala

30%
Più workloads a costi invariati
30%
Workloads in più assorbiti a costi invariati
~€500K
Risparmi annualizzati stimati
NOS

NOS dimezza i costi Kubernetes e ricostruisce la fiducia nell'ottimizzazione

50%
Riduzione dei costi
50%
Riduzione dei costi sul cluster più grande
0%
Risorse inattive sui node pool principali
K1x

K1x abbatte i costi cloud e semplifica le operazioni Kubernetes

Thousands
Risparmio mensile
Thousands
Risparmio mensile sulla spesa cloud
<10%
Utilizzo delle risorse sui nodi sovradimensionati prima dell'ottimizzazione