監視の全体構成
今まで説明してきた監視の構成を図にまとめると以下のようになります。

Datadogに全てのメトリクスを集約させることで、問題に対応するエンジニアはDatadogのみを確認すれば状態を把握できるようになっています。また、アラートの設定もDatadogでほとんど完結させることができます。ログだけは別経路になってしまっていますが、ここについては今後のDatadogの拡張もしくはLogDNAとの連携先の追加などに期待しつつ、より良いサービスがあれば作り変えるかもしれません。
まとめ
本稿ではKARTEにおける監視構成について紹介しました。
多角的な監視ができるようさまざまな情報を取得しておくことは重要で、特にアプリケーションの中に埋め込むことができるカスタムメトリクスの活用は、問題解決までのスピードを高めることができます。
アラートにおいては対応不要なものを設定しないことが大切で、ダッシュボードの活用やアラートメッセージなどによって、あらかじめ対応を明確にしておくことでスピーディな対応が可能です。
また、これらの監視の仕組みはDatadogを中心においた構成をとることで、クラウドプロバイダに依存しない統一的なインターフェースをもたせることができ、効率的な運用が期待できます。
監視構成は日々の運用の中で更に磨き込まれていくと思うので、またの機会に更に磨き込まれた監視構成についてご紹介できればと思います。
