PerfectScalePerfectScale

Cette page est également disponible en English, Deutsch, Español, Italiano, 日本語 et Português.

Un seul ingénieur DevOps pour faire évoluer Riftweaver, grâce à PerfectScale

Le studio de jeux vidéo Riftweaver a réduit le throttling CPU de 59 % et permis à un unique ingénieur DevOps de faire évoluer Kubernetes en toute confiance

PerfectScale
Riftweaver

The Challenge

Riftweaver devait faire évoluer ses environnements Kubernetes pour absorber une charge de joueurs imprévisible, lors du passage de la bêta fermée à l'accès anticipé puis au lancement public. Avec un cluster de production et plusieurs environnements hors production sur AWS EKS, l'ingénieure DevOps Rumby Osei s'appuyait sur Cluster AutoScaler (CAS) pour le scaling des nœuds et sur Horizontal Pod Autoscaler (HPA) pour celui des pods. Lorsque les services ont commencé à subir du throttling, elle s'est tournée vers VPA, mais s'est heurtée à des obstacles : pas de données historiques ni de résultats cohérents. Parmi les principaux points de friction : un throttling CPU fréquent pendant les tests de charge et les sessions de jeu en direct provoquant du lag, un dépannage manuel chronophage avec des métriques contradictoires, et une visibilité limitée des outils existants, dépourvus d'historique et de recommandations actionnables.

The Solution

PerfectScale est devenu un pilier de la stratégie d'infrastructure de Riftweaver. Osei l'utilise pour réduire le throttling CPU en identifiant les workloads à risque et en obtenant des recommandations sur mesure d'ajustement du CPU ; simplifier l'allocation des ressources grâce à des insights sur les nœuds et workloads sous-utilisés, permettant d'optimiser à la fois le placement des pods et le choix des nœuds ; et renforcer la résilience en priorisant les changements selon les profils de risque de PerfectScale, minimisant ainsi les appels API perdus ou dupliqués. L'interface de PerfectScale, ses profils de risque et ses fonctionnalités uniques comme le suivi des émissions de CO2 ont donné à Osei toute confiance dans les recommandations.

Results

  • Réduction du throttling CPU de près de 59 % sur six API critiques
  • Amélioration de l'expérience utilisateur en éliminant les goulots d'étranglement et en réduisant le lag
  • Gestion proactive du scaling par un seul ingénieur DevOps, avec un effort manuel minimal
  • Simplification des opérations pour une équipe DevOps d'une seule personne
  • Accès gratuit à une optimisation de niveau entreprise via le Community Package de PerfectScale
  • Préparation de l'infrastructure à la croissance future, alors que Riftweaver s'étend à de nouvelles plateformes et de nouveaux utilisateurs

PerfectScale a changé la donne. Ses analyses ont non seulement résolu nos problèmes immédiats, mais elles nous ont aussi préparés à notre croissance future, alors que nous nous développons sur davantage de plateformes et auprès de plus d'utilisateurs.

Rumby Osei, Ingénieure DevOps senior chez Riftweaver

Qui est Riftweaver ?

Riftweaver est un studio de jeux vidéo innovant qui a réalisé de grandes avancées au cours de l'année écoulée. Du lancement de son jeu phare à son arrivée sur des plateformes comme Steam et l'iPad, le studio cumule plus de 80 000 téléchargements. Avec une petite équipe de seulement 15 personnes, Riftweaver confie son infrastructure backend à une seule ingénieure DevOps, Rumby Osei, qui veille à ce que l'infrastructure du jeu évolue efficacement tout en offrant une expérience fluide à une communauté de joueurs en pleine croissance.

Le défi

"Quand j'ai rejoint Riftweaver, le jeu ne passait pas à l'échelle et ne supportait pas une charge digne de la production. Mon rôle était de nous y amener", explique Osei. Riftweaver devait faire évoluer ses environnements Kubernetes pour absorber une charge de joueurs imprévisible, lors du passage de la bêta fermée à l'accès anticipé puis au lancement public. Sur AWS EKS avec Cluster AutoScaler et HPA, l'équipe a rencontré des problèmes de throttling. Lorsqu'Osei s'est tournée vers VPA, elle s'est heurtée à des obstacles : "VPA ne fournissait pas de données historiques et ne me permettait pas d'obtenir des résultats cohérents. Impossible de revenir en arrière pour voir ce qui avait changé au fil du temps. J'ai même dû écrire un script pour extraire tous les VPA de chaque déploiement, juste pour comparer les données." Parmi les principaux points de friction : un throttling CPU fréquent pendant les sessions de jeu, un dépannage manuel chronophage et une visibilité limitée des outils existants.

Pourquoi PerfectScale ?

Rumby Osei a commencé à chercher une solution capable de l'aider à prendre des décisions de right-sizing davantage fondées sur les données, à réduire les goulots d'étranglement et à obtenir des insights actionnables sur l'utilisation des ressources. Après un échange avec l'équipe de PerfectScale, elle y a vu le potentiel de combler l'écart entre les prédictions des tests de charge et le comportement réel des utilisateurs, afin d'améliorer la résilience de ses workloads. "L'interface et les profils de risque de PerfectScale m'ont donné confiance dans les recommandations. La solution proposait aussi des fonctionnalités que je n'avais jamais vues ailleurs, comme le suivi de l'impact environnemental avec la mesure du CO2."

La solution : optimiser le scaling et les performances avec PerfectScale

PerfectScale fait désormais partie intégrante de la stratégie d'infrastructure de Riftweaver. Osei l'utilise pour réduire le throttling CPU en identifiant les workloads à risque et en appliquant des recommandations sur mesure d'ajustement du CPU. Les insights sur les nœuds et workloads sous-utilisés lui ont permis d'optimiser à la fois le placement des pods et le choix des nœuds, réduisant le gaspillage et améliorant l'efficacité. En priorisant les changements selon les profils de risque de PerfectScale, Riftweaver minimise les problèmes d'appels API perdus ou dupliqués qui frustraient auparavant les joueurs.

Résultats : un gameplay plus fluide et une efficacité opérationnelle renforcée

PerfectScale aide Riftweaver à monter en charge pour répondre à une demande croissante tout en réduisant la charge opérationnelle. Principaux résultats : une réduction de 59 % du throttling CPU sur six API critiques, pour un gameplay plus fluide ; une expérience utilisateur améliorée avec moins d'interruptions, même aux heures de pointe ; des opérations simplifiées permettant à une équipe DevOps d'une seule personne de gérer proactivement scaling et résilience avec un effort manuel minimal ; et une montée en charge maîtrisée grâce au Community Package de PerfectScale, qui permet d'optimiser l'infrastructure sans pression financière supplémentaire.

Pourquoi PerfectScale fonctionne pour Riftweaver

L'interface intuitive de PerfectScale, ses analyses robustes et ses recommandations actionnables en ont fait un outil essentiel pour la petite équipe dynamique de Riftweaver. Des fonctionnalités comme le suivi de l'impact environnemental et la visibilité sur les HPA s'inscrivent aussi dans l'approche avant-gardiste du studio en matière de gestion d'infrastructure. En intégrant PerfectScale, Riftweaver a optimisé son environnement Kubernetes, garantissant scalabilité, fiabilité et une expérience joueur d'exception. À mesure que le studio grandit, PerfectScale reste un partenaire clé pour offrir aux joueurs du monde entier un gameplay captivant et sans lag.

Découvrez comment PerfectScale améliore l'efficacité de Kubernetes

Explorez comment PerfectScale aide les équipes à faire du right-sizing de leurs clusters, réduire le gaspillage et améliorer les performances, sans réglages manuels.

More customer stories

PicnicAI

PicnicAI automatise 85 à 90 % de ses workloads Kubernetes et gagne en fiabilité avec PerfectScale by DoiT

85–90%
des workloads applicatifs désormais couverts par le redimensionnement automatisé
50%
de réduction approximative du temps consacré par l'équipe à la gestion de l'infrastructure
Stefanini

Stefanini réduit de 26 % ses coûts de compute Kubernetes grâce à PerfectScale by DoiT

26%
De réduction des coûts de compute Kubernetes
>60%
De réduction des coûts d'infrastructure au cours de l'année écoulée
OneFootball

PerfectScale by DoiT aide OneFootball à optimiser Kubernetes face au trafic football mondial à grande échelle

25%
De réduction des coûts d'infrastructure Kubernetes
80%
De réduction de l'effort d'ingénierie consacré à l'optimisation des coûts et au réglage de la résilience Kubernetes
Luma Health

Luma Health réduit ses coûts EKS de 40 % et libère des milliers d'heures d'ingénierie par an

90%
De temps en moins sur le rightsizing manuel de Kubernetes
40%
De réduction des coûts Amazon EKS
+1,700h/year
D'heures d'ingénierie réorientées vers la fiabilité et la performance
PlayHQ

PlayHQ optimise ses coûts Kubernetes multi-tenant

40%
De réduction des coûts Kubernetes hors production
40%
De réduction des coûts K8s hors production
20%
De réduction des coûts K8s en production
SNCF

Comment la SNCF a éliminé le gaspillage K8s et renforcé sa fiabilité à grande échelle

30%
De workloads en plus à coût constant
30%
De workloads absorbés en plus à coût constant
~€500K
D'économies annualisées estimées
NOS

NOS divise ses coûts Kubernetes par deux et retrouve confiance dans l'optimisation

50%
Réduction des coûts
50%
De réduction des coûts sur le plus grand cluster
0%
De ressources inutilisées sur les node pools principaux
K1x

K1x réduit drastiquement ses coûts cloud et simplifie ses opérations Kubernetes

Thousands
D'économies par mois
Thousands
D'économies mensuelles sur les dépenses cloud
<10%
D'utilisation des ressources sur les nœuds surdimensionnés avant optimisation