PerfectScalePerfectScale

Diese Seite ist auch in English, Español, Français, Italiano, 日本語 und Português verfügbar.

Wie ein einzelner DevOps Engineer Riftweaver mit PerfectScale skaliert

Das Gaming-Studio Riftweaver hat das CPU-Throttling um 59 % gesenkt – und ein einzelner DevOps Engineer skaliert Kubernetes jetzt souverän

PerfectScale
Riftweaver

The Challenge

Riftweaver stand vor der Herausforderung, seine Kubernetes-Umgebungen so zu skalieren, dass sie die unvorhersehbare Spielerlast beim Übergang von der Closed Beta über den Early Access bis zum öffentlichen Launch bewältigen konnten. Mit einem Produktionscluster und mehreren Non-Production-Umgebungen auf AWS EKS setzte DevOps Engineer Rumby Osei auf den Cluster AutoScaler (CAS) für die Node-Skalierung und den Horizontal Pod Autoscaler (HPA) für die Pod-Skalierung. Als bei einzelnen Services Throttling-Probleme auftraten, griff sie auf VPA zurück – und stieß auf Hindernisse: Das Tool lieferte weder historische Daten noch konsistente Ergebnisse. Zu den größten Problemen zählten häufiges CPU-Throttling bei Lasttests und im laufenden Spielbetrieb mit spürbarem Lag, zeitaufwendige manuelle Fehlersuche mit widersprüchlichen Metriken sowie die eingeschränkte Transparenz der vorhandenen Tools, denen historische Einblicke und umsetzbare Empfehlungen fehlten.

The Solution

PerfectScale wurde zu einem festen Bestandteil der Infrastrukturstrategie von Riftweaver. Osei nutzt die Lösung, um CPU-Throttling zu reduzieren, indem risikoreiche Workloads identifiziert und passgenaue Empfehlungen für CPU-Anpassungen bereitgestellt werden; um die Ressourcenzuteilung durch Einblicke in unterausgelastete Nodes und Workloads zu vereinfachen und so Pod-Platzierung wie Node-Auswahl zu optimieren; und um die Resilienz zu verbessern, indem Änderungen anhand der Risikoprofile von PerfectScale priorisiert werden – so lassen sich Probleme wie verlorene oder doppelte API-Aufrufe minimieren. Die UI, die Risikoprofile und einzigartige Funktionen wie das CO2-Tracking von PerfectScale gaben Osei das nötige Vertrauen in die Empfehlungen.

Results

  • CPU-Throttling über sechs kritische APIs hinweg um fast 59 % reduziert
  • Nutzererlebnis durch behobene Performance-Engpässe und weniger Lag verbessert
  • Einem einzelnen DevOps Engineer proaktives Skalierungsmanagement mit minimalem manuellem Aufwand ermöglicht
  • Abläufe für ein Ein-Personen-DevOps-Team verschlankt
  • Optimierung auf Enterprise-Niveau über das Community Package von PerfectScale kostenlos genutzt
  • Infrastruktur auf künftiges Wachstum vorbereitet – für die Expansion auf weitere Plattformen und Nutzer

PerfectScale hat für uns alles verändert. Die Erkenntnisse haben nicht nur akute Probleme gelöst, sondern uns auch auf künftiges Wachstum vorbereitet, während wir auf weitere Plattformen und Nutzer expandieren.

Rumby Osei, Senior DevOps Engineer bei Riftweaver

Wer ist Riftweaver?

Riftweaver ist ein innovatives Gaming-Studio, das im vergangenen Jahr große Fortschritte gemacht hat. Vom Launch seines Flaggschiff-Spiels bis zur Einführung des Gameplays auf Plattformen wie Steam und iPads – das Studio verzeichnet über 80.000 Downloads seines Spiels. Bei einem kleinen Team von nur 15 Mitarbeitenden liegt die Backend-Infrastruktur von Riftweaver in den Händen eines einzigen DevOps Engineers: Rumby Osei. Sie sorgt dafür, dass die Infrastruktur des Spiels effizient skaliert und die wachsende Spielerbasis ein reibungsloses Erlebnis genießt.

Die Herausforderung

"Als ich zu Riftweaver kam, konnte das Spiel weder skalieren noch produktionsreife Last bewältigen. Meine Aufgabe war es, genau das zu ändern", sagt Osei. Riftweaver stand vor der Herausforderung, seine Kubernetes-Umgebungen so zu skalieren, dass sie die unvorhersehbare Spielerlast beim Übergang von der Closed Beta über den Early Access bis zum öffentlichen Launch bewältigen konnten. Die Umgebung lief auf AWS EKS mit Cluster AutoScaler und HPA, und das Team kämpfte mit Throttling-Problemen. Als Osei auf VPA zurückgriff, stieß sie auf Hindernisse: "VPA lieferte weder historische Daten noch konsistente Ergebnisse. Ich konnte nicht nachvollziehen, was sich im Laufe der Zeit verändert hatte. Ich musste sogar ein Skript schreiben, um alle VPAs für jedes Deployment abzurufen – nur um Daten vergleichen zu können." Zu den größten Problemen zählten häufiges CPU-Throttling im Spielbetrieb, zeitaufwendige manuelle Fehlersuche und die eingeschränkte Transparenz der vorhandenen Tools.

Warum PerfectScale?

Rumby Osei suchte nach einer Lösung, mit der sie datenbasierte Right-Sizing-Entscheidungen treffen, Performance-Engpässe reduzieren und verwertbare Einblicke in die Ressourcennutzung gewinnen konnte. Nach einem Gespräch mit dem Team von PerfectScale erkannte Osei das Potenzial, die Lücke zwischen Lasttest-Prognosen und realem Nutzerverhalten zu schließen und so die Resilienz ihrer Workloads zu verbessern. "Die UI und die Risikoprofile von PerfectScale haben mir das nötige Vertrauen in die Empfehlungen gegeben. Außerdem bot die Lösung Funktionen, die ich so noch nie gesehen hatte – etwa das Monitoring der Umweltauswirkungen per CO2-Tracking."

Die Lösung: Skalierung und Performance mit PerfectScale optimieren

PerfectScale ist heute ein fester Bestandteil der Infrastrukturstrategie von Riftweaver. Osei nutzt die Lösung, um CPU-Throttling zu reduzieren: Risikoreiche Workloads werden identifiziert und passgenaue Empfehlungen für CPU-Anpassungen bereitgestellt. Einblicke in unterausgelastete Nodes und Workloads ermöglichten es ihr, sowohl die Pod-Platzierung als auch die Node-Auswahl zu optimieren – für weniger Verschwendung und mehr Effizienz. Indem Riftweaver Änderungen anhand der Risikoprofile von PerfectScale priorisiert, minimiert das Studio Probleme wie verlorene oder doppelte API-Aufrufe, die Nutzer zuvor frustriert hatten.

Die Ergebnisse: Flüssigeres Gameplay und effizienter Betrieb

PerfectScale hilft Riftweaver, mit der wachsenden Nachfrage Schritt zu halten und gleichzeitig den operativen Aufwand zu senken. Die wichtigsten Ergebnisse: 59 % weniger CPU-Throttling über sechs kritische APIs hinweg – für flüssigeres Gameplay; ein besseres Nutzererlebnis mit weniger Unterbrechungen selbst zu Spitzenzeiten; verschlankte Abläufe, dank derer ein Ein-Personen-DevOps-Team Skalierung und Resilienz mit minimalem manuellem Aufwand proaktiv steuern kann; sowie kosteneffizientes Skalieren über das Community Package von PerfectScale, mit dem das Team seine Infrastruktur ohne zusätzliche finanzielle Belastung optimiert.

Warum PerfectScale die richtige Wahl für Riftweaver ist

Die intuitive Oberfläche, die leistungsstarken Analysen und die umsetzbaren Empfehlungen von PerfectScale machten die Lösung zu einem unverzichtbaren Werkzeug für das kleine, aber dynamische Team von Riftweaver. Funktionen wie das Tracking der Umweltauswirkungen und der Einblick in HPA passten zudem perfekt zum zukunftsorientierten Infrastruktur-Ansatz des Studios. Mit PerfectScale hat Riftweaver seine Kubernetes-Umgebung optimiert und Skalierbarkeit, Zuverlässigkeit und ein erstklassiges Spielerlebnis sichergestellt. Während das Studio weiter wächst, bleibt PerfectScale ein wichtiger Partner auf dem Weg, Spielern weltweit spannendes Gameplay ohne Lag zu bieten.

Erfahren Sie, wie PerfectScale die Kubernetes-Effizienz steigert

Entdecken Sie, wie Teams mit PerfectScale ihre Cluster per Right-Sizing optimal dimensionieren, Verschwendung reduzieren und die Performance verbessern – ganz ohne manuelles Tuning.

More customer stories

PicnicAI

PicnicAI automatisiert 85–90 % der Kubernetes-Workloads – und gewinnt Zuverlässigkeit mit PerfectScale by DoiT

85–90%
der Anwendungs-Workloads jetzt durch automatisiertes Resizing abgedeckt
50%
weniger Zeitaufwand des Infrastruktur-Teams für Infrastruktur (ca.)
Stefanini

26 % weniger Kubernetes-Compute-Kosten: Stefanini optimiert mit PerfectScale by DoiT

26%
Weniger Kubernetes-Compute-Kosten
>60%
Geringere Infrastrukturkosten im letzten Jahr
OneFootball

Kubernetes-Optimierung im Takt des Weltfußballs

25%
weniger Kosten für die Kubernetes-Infrastruktur
80%
weniger Engineering-Aufwand für Kubernetes-Kostenoptimierung und Resilienz-Tuning
Luma Health

Luma Health senkt EKS-Kosten um 40 % und gewinnt jährlich Tausende Engineering-Stunden zurück

90%
Weniger Zeit für manuelles Kubernetes-Right-Sizing
40%
Weniger Amazon-EKS-Kosten
+1,700h/year
Engineering-Stunden für Zuverlässigkeit und Performance
PlayHQ

PlayHQ optimiert Kubernetes-Kosten im Multi-Tenant-Betrieb

40%
Reduzierung der Non-Production-Kubernetes-Kosten
40%
Reduzierung der Non-Production-K8s-Kosten
20%
Reduzierung der Production-K8s-Kosten
SNCF

Wie SNCF Kubernetes-Waste reduzierte und die Zuverlässigkeit im großen Maßstab steigerte

30%
Mehr Workloads bei gleichbleibenden Kosten
~€500K
Geschätzte jährliche Einsparungen
250
Optimierte Cluster
NOS

NOS halbiert Kubernetes-Kosten und gewinnt Vertrauen in Optimierung zurück

50%
Kostensenkung
50%
Kostensenkung auf dem größten Cluster
0%
Ungenutzte Ressourcen auf zentralen Node-Pools
K1x

K1x senkt Cloud-Kosten drastisch und vereinfacht den Kubernetes-Betrieb

Thousands
Ersparnis pro Monat
Thousands
Monatliche Ersparnis bei den Cloud-Kosten
<10%
Ressourcenauslastung überdimensionierter Nodes vor der Optimierung