オンプレ→クラウド移行で絶対に外せない“運用”のポイントまとめ
はじめに
オンプレで長く運用してきたシステムをクラウドへ移行する――
一見シンプルな作業に見えて、実際に着手すると
「どこから考えればいいのか」途端に輪郭がぼやけてきます。
そこで本記事では、クラウド移行で“最低限ここは押さえておきたい”という観点を
見積・設計・テスト/移行・運用の4フェーズに分けて整理しました。
今回はその中でも 「運用」フェーズについて解説します。
現場でつまずきがちなポイントにも触れながら、
できるだけ多くの環境で応用できる内容を目指しています。
これからクラウド移行を検討する方、
すでにプロジェクトに関わっている方の参考になれば幸いです。
筆者について
入社から10年ほど、オンプレシステムの開発・保守・運用に携わってきました。
あるタイミングでクラウドを扱う部門へ異動となり、
オンプレ歴の長いエンジニアがクラウドへ踏み出す際に感じたギャップや気付きをもとに、
本記事を執筆しています。
クラウド移行で“最初に”考えるべき運用のポイント
運用スケジュール
メンテナンス時間
システムは利用するだけでなく、
バックアップやパッチ適用等メンテナンスのための時間も用意しておく必要があります。
特に以下の処理は、可能であればユーザーが利用しない時間帯に実施したいところです。
- システムバックアップ/データバックアップ
- サーバ再起動
- パッチ適用/製品バージョンアップ
特にクラウドの場合上記をクラウドサービスで実装していることが多いです。
サーバ再起動やパッチ適用はクラウドベンダー側の都合で実施されることも少なくないため、
「この時間なら止めても問題ない」というメンテナンス枠を
あらかじめ設計に織り込んでおくことが重要になります。
監視設計
監視手法
監視についての考え方はオンプレもクラウドも変わらないです。
監視手法としては以下2つに分かれるかと思いますが、
サービス停止や閾値超過等監視条件の考え方は同様でよいかと思います。
- OS/ミドルウェアなどの一般的な監視
- クラウドサービス固有の監視(例:マネージドDB、LB、API Gateway など)
コスト監視
クラウド監視でオンプレにない要素の1つとしてコスト監視があります。
クラウドは使った分だけコストがかかる従量課金制のため、
監視をしないと際限なくコストがかさむリスクがあります。
ただし、監視でアラートが上がっても即座に改善できないケースが多いため、
月次・週次で「上がり方の傾向」を見ることが欠かせません。
コスト監視は「アラートを上げる」より「異常傾向を早く察知する」方が重要です。
コスト監視を行う上で最低限以下は監視すべきです。
- 月額予算に対するアラート
- 異常な増加率検知
- 利用リソースの定点観測
定期/非定期運用
クラウドによる運用自動化
システムはリリースして終わりではなく、定期/非定期の各種運用作業が発生します。
こういった運用作業の多くはクラウド側で自動化できるサービスが提供されています。
障害時に自動リカバリ(再起動、スケールアウトなど)を行うサービスもあり、
運用コスト削減にもつながるため積極的に導入を検討するべきです。
運用作業の例としては以下です。
- 定期的なパスワード変更
- 定期的な性能情報取得
- 障害発生時の一時切り分け
既存の手作業を棚卸しし、「クラウドのどのサービスで自動化できるか」を洗い出してみると、
大きな効率改善につながることが多いです。
運用作業の整理は以下流れで実施します。
運用フェーズの要点をもう一度整理
最後に運用フェーズで最低限気を付けたほうが良いポイントについてチェックリスト化しました。
クラウド化を検討する際に参考になれば幸いです。
✅ 運用フェーズ チェックリスト
▼ 運用スケジュール
■ 運用項目の整理
■ メンテナンス時間の確保
▼ 監視
■ 一元的なモニタリング
■ コスト監視方法の整理
▼ 定期/非定期運用
■ 定期/不定期作業の見直し
Discussion