Kubernetesワークロードの85〜90%を自動化——PicnicAIがPerfectScale by DoiTで信頼性を向上
- 85–90%
- 自動リサイズが適用されたアプリケーションワークロードの割合
- 50%
- インフラチームがインフラ管理に費やす時間の削減率(概算)
大企業からスピンアウトした後、K1xは複数のKubernetesクラスターを引き継ぎましたが、当初それらを運用していたチームメンバーは一人も残りませんでした。プラットフォーム運用責任者のJason Berk氏が目の当たりにしたのは、深刻な過剰プロビジョニングでした。ノードプールは必要な最小スケールの2〜3倍で稼働しているにもかかわらず、リソース使用率は10%未満。ワークロードはベストプラクティスに沿わない形でデプロイされ、高価なコンピューティング最適化ノードが不必要に使われていました。さらに可観測性も限られており、Prometheusは生のメトリクスを表示するだけで実用的なインサイトは得られず、最適化はまさに「干し草の山から針を探すようなもの」でした。
何を、どのように測定すべきかを何時間もかけて手作業で突き止める代わりに、Berk氏はPerfectScaleを導入し、すぐに実行に移せるKubernetes最適化の推奨事項を手に入れました。PerfectScaleはノードレベルの可視性を提供してアイドルリソースを特定し、ワークロードのCPU・メモリ割り当てをライトサイジング。メモリリークをはじめとする重大な問題を顕在化させ、チューニングを自動化しました。これによりBerk氏は、少人数のチームでKubernetesを管理しながら、戦略的な優先事項に集中できるようになりました。
PerfectScaleは、私たちが必要としていた答えをそのまま差し出してくれました。そのインサイトのおかげで、時間もコストも節約できました。
Jason Berk, K1x プラットフォームオペレーター
K1xは、ニュージャージー州に拠点を置く急成長中のAI搭載税務ソフトウェアプロバイダーです。革新的な税務ソリューションを大規模に市場展開するため、大企業からスピンアウトしました。技術スタックにはAzure AKS、ArgoCD、Terraformが含まれます。スピンアウトに伴い、K1xは複数のKubernetesクラスターを移行しましたが、それらを運用していたチームメンバーは残らず、プラットフォーム運用責任者のJason Berk氏がアーキテクチャの改善と、変化の速いエンジニアリングチームのサポートを担うことになりました。
Jason氏がK1xに参画したとき、Kubernetes環境全体に数多くの最適化の余地があることに気づきました。ノードプールは過大なサイズで多くのリソースを浪費しており、必要な水準の2〜3倍の最小スケールで稼働しながら、利用可能な容量の10%未満しか使われていませんでした。ワークロードはベストプラクティスに完全には沿わない形でデプロイされ、高価なコンピューティング最適化ノードが不必要に使用され、Prometheusなどの既存ツールは生のメトリクスを表示するだけで実行可能な指針を示してくれませんでした。Berk氏は次のように語ります。「クラスター内のノードは、実際に必要な量の2〜3倍の最小スケールで稼働していました。自動でスケールアップされることは一度もないのに、リソースの使用率は10%未満で、必要なのはスケールダウンでした。とてつもない無駄だったのです」
Berk氏には、最適化の機会を素早く特定し、実行可能な推奨事項を提示できるソリューションが必要でした。「CTOにこう伝えました。何をどう測定すべきか、そもそも正しくできているのかを自分で突き止めるには何時間もかかる。それならPerfectScaleを買えばいい。そのほうが速く、安く問題を解決できる、と」。PerfectScaleは「このワークロードには、この設定が最適」という実行可能なインサイトを提供し、ノードの使用率とワークロード設定を明確に可視化。Kubernetesの最適化をシンプルにし、Berk氏の時間を大幅に節約しました。
PerfectScaleは、K1xのKubernetes環境に潜む非効率を即座に明らかにしました。「PerfectScaleのおかげで、『なぜこのワークロードをこのノードプールで動かしているのか』といった、本質を突く問いを立てられるようになりました。数か月のうちにそれらのノードプールを完全に停止し、月々数千ドルを節約できました」。同プラットフォームにより、K1xはノードレベルでのアイドルリソースの排除、開発者向けの明確なCPU・メモリ推奨によるワークロードのライトサイジング、メモリリークなどの重大な問題の顕在化(修正前に1か月で4,000回も再起動していたアプリの発見を含む)、そして自動チューニングによる運用の効率化を実現しました。
1か月以内に、K1xはノードプール全体を停止し、月々数千ドルの節約分を予算に還元しました。コスト削減にとどまらず、PerfectScaleはメモリリークやリソースのボトルネックといったワークロードの不安定要因を排除し、レジリエンスを向上させました。さらに、Berk氏は少人数のチームでもKubernetesを効果的に管理できるようになりました。
PerfectScaleにより、Berk氏はK1xのKubernetesを高度に最適化された環境へと変革できました。インサイト、自動化、継続的なサポートを活用して、戦略的な改善を素早く提案し、実行に移せます。Berk氏はパートナーシップも高く評価しています。「PerfectScaleから受けたマンツーマンのサポートには驚かされました。質問にはすぐ答えてくれますし、必要なときには問題解決まで丁寧に導いてくれます。私のような立場の人間にとって、まさに救世主です」
PerfectScaleが手動チューニングなしで、クラスターのライトサイジング、無駄の削減、パフォーマンス向上をどのように支援するかをご覧ください。