PerfectScale by DoiTがOneFootballのKubernetesを世界中のサッカートラフィックに合わせて最適化
- 25%
- Kubernetesインフラコスト削減
- 80%
- Kubernetesのコスト最適化とレジリエンシーチューニングに費やすエンジニアリング工数の削減
経営層から強力な効率化目標を課されたTraxは、Kubernetesクラスターの最適化で壁に直面していました。VPAやモニタリングツールによる手作業の最適化は判断材料に乏しく、スケールも困難。承認プロセスもエビデンスではなく勘に頼っており、エンジニアの疲弊とサービスリスクを招いていました。
PerfectScaleは、Traxの200超のマイクロサービス環境全体にリアルタイムかつworkload単位の可視性をもたらしました。AIによる分析でSLOを守りながらエビデンスに基づく安全な最適化が可能となり、成果を出せていなかったFinOpsツールを置き換え、粒度の高いコスト情報と実行可能な推奨を提供しています。
これまで使っていたFinOpsツールは、粒度の細かいコスト情報も、環境を最適化するためのガイダンスも提供してくれませんでした。PerfectScale by DoiTは財務部門だけでなくEngineersのために作られたツールで、私たちが目指していたコスト面の成果を実現しやすくなりました。
Mark Serdze, Trax Director of Cloud Infrastructure
Traxのミッションは、ブランドや小売事業者がデジタル技術の力を活用し、顧客に最高のショッピング体験を届けられるよう支援することです。業界をリードするイノベーションと、先進テクノロジーや自律的なデータ収集手法における卓越した開発力により、優れた購買体験を生み出し、あらゆる販売拠点で売上機会を引き出しています。Traxのソリューションportfolioは、ミッションクリティカルな指標・分析・サービスを通じて顧客のショッピング体験を改善し、時間とコストの削減に貢献します。Kubernetesは同社インフラの中核であり、需要に応え続けるスケーラビリティを確保しながら、ソリューションの継続的な進化を支えています。Traxは現在、世界最大級の企業を含む90か国以上の顧客を支える、大規模なマルチクラウド・マルチクラスター環境へと成長しました。
年初、CFO(最高財務責任者)は組織全体に対して効率化とユニットエコノミクスの強い目標を打ち出しました。Director of Cloud InfrastructureのMark Serdze氏率いるチームにとって、これはクラウドコスト最適化への即時着手を意味しました。Kubernetes以外の領域では早期に成果が出たものの、クラスター内部での安全かつ大規模な最適化では壁にぶつかります。チームはVertical Pod Autoscaler(VPA)、クラスターログ、モニタリングソリューションといった利用可能な指標を使い、手作業による最適化に着手。しかしこのやり方では十分な見通しが得られず、大きな開発投資なしに効率的にスケールさせることは困難でした。結果として、目標達成にほとんど寄与しない場当たり的・受動的な対応に終始していたのです。既存ツールも最適化プロセスに摩擦を生んでいました。メンバーが改善余地を見つけても、最善策を検証する承認プロセスはエビデンスではなく勘に基づくもの。可視性の欠如から判断ミスも生まれ、エンジニアの追加負担、社内の軋轢、サービスの耐障害性を損ないかねないリスクを招いていました。
PerfectScale by DoiTの導入から間もなく、チームはこれまで欠けていたリアルタイムかつworkload単位の可視性を手にしました。200超のマイクロサービス環境全体で、各サービスに必要なリソースを明確に把握し、パフォーマンスを損なわずに無駄を排除できる最大の機会を特定できるようになりました。プラットフォームのAIによる分析により、エビデンスに基づく安全な施策を実行し、ユニットエコノミクスを迅速に改善。効率と耐障害性のトレードオフを見極めながら、SLOを守りつつ安全かつ効率的にリソースを調整できるようになりました。コスト最適化の推奨は特に有用で、各変更がもたらす影響を明確に示しながら取るべきアクションを提示してくれます。あるクラスターでは75%のコスト削減を達成し、年間10万ドル超を節約。さらにTraxは、環境全体を網羅する包括的なデータと分析力にも感銘を受けました。この導入により、予算を圧迫することなくコスト可視化のツールセットを刷新できたのです。
無駄なリソースを排除した後、Traxは効率とユニットエコノミクスをさらに高める機会の特定に注力しました。チームはPerfectScaleのデータを深掘りし、コスト中心のビジネス指標に有意義なインパクトを与える方法を探索。Traxにとって重要な指標である「処理あたりコスト」は、Kubernetesの効率に大きく左右されます。PerfectScaleには、サービスの全レプリカを単一のビューに統合し、レプリカ全体の利用傾向を明快に可視化するユニークな機能があり、SparkやFlinkジョブのような一時的なworkloadsに特に有効です。Traxはこの機能を活用し、利用頻度の高い複数サービスにおけるレプリカ間の不均一な利用状況を深く理解しました。この粒度の可視性により、耐障害性や可用性を損なうことなく追加の効率改善を狙ったサービス再設計が可能に。リソース構成の異なる複数バージョンのサービスを用意し、データサイズに応じて適切なサービスへリクエストを振り分ける仕組みを構築しました。これが「処理あたりコスト」指標に大きく寄与しました。PerfectScaleはこのデータを即座に提示してくれます。同ツールがなければ、同じ結果を得るために何百ものレプリカを評価する膨大な時間を費やしていたでしょう。
PerfectScaleがクラスターのライトサイジング、無駄の削減、手作業によるチューニングなしでのパフォーマンス改善をどう実現するかをご覧ください。