DEVELOPER’s BLOG

技術ブログ

SRE:AWSのインフラ費用削減の進め方紹介

2026.02.12 伊達 政徳
AWS SRE
SRE:AWSのインフラ費用削減の進め方紹介

目次

  • はじめに
  • 進め方概要
  • ステップ① コスト削減
  • コスト最適化支援
  • 施策実施
  • ステップ② 継続運用の体制を構築
  • 運用設計支援
  • 監視基盤構築
  • AWS Cost Anomaly Detection とは
  • ステップ③ 予防処置の体制を構築
  • 運用設計支援
  • AWS Budgets とは
  • AIを活用した予兆検知基盤構築
  • おわりに

  • はじめに

    みなさんこんにちは。インフラエンジニアの伊達です。
    やはり何事もコストは最小限で済ませたいものですよね。
    システムは大きな問題もなく安定稼働を続けているものの、
    インフラ費用をもう少し抑えられないものか気になっている...。
    そういったお悩みを抱えている企業様向けに、弊社ではSREのサービスを行っております。
    進め方のイメージとともにご紹介していきます。

  • 参考:
    そもそもSREとは何かについては→SREとは?
    コスト削減については→AWSコスト削減サービス
    もご覧ください。

  • 進め方概要

    コストの削減について、以下のようなステップで進めていきます。

    SRE:AWSコスト削減
    ステップサブステップ期間
    ステップ① コスト削減コスト最適化支援約1ヶ月
    施策実施約1ヶ月〜
    ステップ② 継続運用の体制を構築運用設計支援約1ヶ月
    監視基盤構築約1ヶ月
    ステップ③ 予防処置の体制を構築運用設計支援約1ヶ月
    AIを活用した予兆検知基盤構築約2ヶ月



    ステップ① コスト削減

    コスト削減のご相談をいただいたら、まずは現状の把握を行い、削減可能な箇所を特定します。
    改善が可能であれば、ご提案させていただく改善策を実施することでコスト削減を実現します。


    sre_cost_optimization1.png

    コスト最適化支援

    スペックの高いリソースを使ったり、多くの通信を行ったり、大量のデータを保存したりすれば、コストがかかるのは自然なことです。
    しかしそれらが必要以上のスペック、過剰な冗長化に伴うデータ同期の通信、不要なデータの保存などであればコスト削減のポイントになります。
    現状の環境にそのような点がないか確認し、改善策をご提案させていただきます。


    施策実施

    ご提案した改善策にご納得いただき実施することになった場合、「SRE伴走支援サービス」にてご支援させていただきます。実施については、貴社またはご担当ベンダー様にて行っていただくことも、ご要望があれば弊社で行うことも可能です。


    ステップ② 継続運用の体制を構築

    ステップ①でのコスト削減は、あくまで一回限りの対処です。
    その後もシステムは稼働を続けるため、継続して正常に運用することが重要であり、そのための体制が必要です。


    sre_cost_optimization2.png

    運用設計支援

    ステップ①でコスト削減を実施しても、その後放置しておけば状況は変化していくものです。
    システムが稼働している環境もそれを利用するユーザも毎日同じではありません。
    常にコストを監視して、異常に気づける仕組み・体制を作っておく必要があります。
    どのリソースをどう監視するか、コスト監視の運用設計を支援させていただきます。


    監視基盤構築

    Cost Anomaly Detectionを活用してシステムを監視し、「異常」と判断された場合にアラートを出す仕組みを構築します。
    コスト異常の早期発見・早期対応が可能となり、不要な支出が継続する事態を未然に回避できます。
    これには、アラートを受け取り対処を行うための体制も必要となります。


    AWS Cost Anomaly Detection とは

    AWS Cost Explorerを日々注意深くチェックすればコストの異変に気付くことも可能ですが、 AWS Cost Explorerの機能である AWS Cost Anomaly Detection を使えば自動的に「いつもと違うコスト増加」を検出することができます。
    機械学習モデルを用いることで人間では見落としがちな変化に対する警告が出せることに加え、常時監視という人手では難しい運用ができるため是非とも設定しておきたい機能です。

    参考(公式):https://aws.amazon.com/jp/aws-cost-management/aws-cost-anomaly-detection/


    ステップ③ 予防処置の体制を構築

    ステップ②で「コスト異常が発生したら」アラートを出すように設定し、それを受けてすぐに対処できる体制を組む話をしました。
    しかし、そもそも「コスト異常が発生しない」ように兆候を検知し、事前に対処できる仕組みを構築できれば、対応が後手に回る頻度を減らすことができます。


    sre_cost_optimization3.png

    運用設計支援

    サービスコントロールポリシー (SCP)を適切に設定することで、利用を想定していないサービスのリソース作成を制限できます。

    AWS Budgetsを活用することで、予算管理を行いコストが想定よりかかる「予測」となった時点で通知を出せるため、
    実際にはまだコスト異常が発生していない段階での対応が可能です。
    こうした未然防止のための運用設計を支援させていただきます。

    AWS Budgets とは

    予算管理として設定した予算や閾値に基づいて、コストを監視してアラートを出したり、自動的にアクションを行ったりもできるサービスです。
    また、「使用量」に関する監視も行えます。
    金額が絶対的に大きいと「無駄を含んでいるのでは...?」と自然に疑うことができますが、中には一見しただけでは判別しにくい「見えない無駄」も存在します。
    コストを抑えるつもりでリザーブドインスタンスやSavings Plans を購入したものの、
    実はその後想定していたほど使われていなかった、というケースを考えてみましょう。
    その場合、支出額自体は増加しないため、「コスト」だけ見ていても気付くことができません。
    なぜ使われなくなったのかという原因分析は後で行うにしても、少なくとも次の更新時にはオンデマンドに戻すなど何かしらの対応が必要になります。
    AWS Budgetsでリザーブドインスタンスや Savings Plans の利用率に対して閾値を設定しておくことでそのような事態にも早い段階で気付くことができます。

    参考(公式):https://aws.amazon.com/jp/aws-cost-management/aws-budgets/


    AIを活用した予兆検知基盤構築

    ここまで挙げてきた例などは構成によらない一般的な話でした。
    紹介したサービスの中でも既に機械学習を活用しているものがありますが、
    将来的にはAIによる判断を最大限に活用しそれぞれの環境に最適化することで、
    AWS標準機能では捉えきれないような環境固有のコスト異常の兆候を検知できる監視AIシステムも作れるかもしれません。


    おわりに

    最後の話はまだ将来の可能性の段階で、今すぐに実現できるものではありませんが、
    現時点でできることもたくさんあるはずです。
    まずは現状の確認から始めてみてはいかがでしょうか?



    X(旧Twitter)・Facebookで定期的に情報発信しています!

    関連記事

    EOL管理のコストと手間を解消!Amazon InspectorとAIで実現する低負担な方法

    目次 はじめに:EOL管理、やった方がいいのはわかっているけど...... 1.EOL管理には、3つの壁がある 2.Amazon Inspectorと生成AIで実現する、第三の選択肢 3.実際にやってみました 4.低コスト・低負担で運用を続けられる 結論:EOL管理は、思っているほど大変じゃない はじめに:EOL管理、やった方がいいのはわかっているけど...... EOL(End of Life)をしっかり管理することは、ソフトウェアの

    記事詳細
    EOL管理のコストと手間を解消!Amazon InspectorとAIで実現する低負担な方法
    AWS 生成AI
    DevOps Agentとは?マルチクラウド時代の自律型AI運用ガイド

    マルチクラウドやハイブリッド環境が当たり前になったいま、SREやDevOpsチームの皆様は、こんな悩みを抱えていないでしょうか。 サービスと環境が増え続け、全体像が誰の頭にもない 各社クラウド・オンプレが入り組み、障害原因の切り分けに時間がかかりすぎる デプロイ起因の障害はコード変更まで追うのが大変 こうした課題を打破するのが、2026年3月に一般提供開始された「AWS DevOps Agent」です。 本記事では、その概要とAIエージェントを真の戦力にす

    記事詳細
    DevOps Agentとは?マルチクラウド時代の自律型AI運用ガイド
    AWS SRE 生成AI
    AIによる組織変革の新たな一手「AI BPR」とは?

    「生成AIで月◯万時間の削減!」 そんな華々しい成果をニュースで見かけて自社でも生成AIを導入したものの、次のような壁にぶつかっていませんか? 個人の利用止まりで、組織の業務フロー自体は変わっていない 一部の層はAIを使ってくれるが、全社的に広がっていかない 業務プロセスのどこにAIを組み込むべきか具体化しない こうした悩みは、AI導入におけるアプローチの「前提」に原因があります。 本記事では、この壁を破る新たな手法「AI BPR(AI-driven B

    記事詳細
    AIによる組織変革の新たな一手「AI BPR」とは?
    AWS 生成AI
    守る運用に改善するSREを。AIエージェントで効率的なSREの実践方法

    深夜のアラート対応、障害調査のログ突き合わせ、セキュリティ検知のトリアージ。毎月の報告書は「異常なし」なのに、同じインシデントが繰り返される。そんなシステム運用に疲弊していませんか。 原因は担当者の能力でも姿勢でもなく、体制にあります。安定を守る責任が重いほど、改善に割く余力は構造的になくなっていくためです。このことを改善する方法がSRE(Site Reliability Engineering)ですが、必要なエンジニアリングコストの高さが導入の壁でした

    記事詳細
    守る運用に改善するSREを。AIエージェントで効率的なSREの実践方法
    AWS SRE 生成AI

    お問い合わせはこちらから