既に導入されているZabbix・Grafana・Prometheus等の監視環境を調査し、実際に機能する状態へ整理・改善します。
大規模なコンシューマー向けサービスのインフラ・バックエンドを6年以上担当し、実際に障害対応を行ってきた経験から、「本当に必要なアラート」と「ノイズになっているアラート」を見極めます。
■対応範囲
・現在の監視設定の調査と可視化(何をどう監視しているかの整理)
・不要なアラートの整理、閾値の見直し
・監視されていない重要項目の洗い出しと追加設定
・Grafanaダッシュボードの新規作成・改善
・通知先・通知条件の見直し(メール/Slack等)
・引き継ぎ用の運用ドキュメント作成
■対応可能な環境
・OS:Ubuntu、Amazon Linux、Rocky Linux / CentOS、Debian 等の各種Linux
・クラウド:AWS(EC2 等)、Google Cloud、各種VPS
・オンプレミス環境
・監視ツール:Zabbix、Prometheus、Grafana 等
■進め方
1.現状のヒアリング(監視ツール、サーバー台数、困っている点)
2.現在の設定内容を調査し、現状をレポートにまとめてご報告
3.改善方針のご提案・すり合わせ
4.設定変更の実施
5.変更内容のご説明・ドキュメント提供
■私の強み
・「今この監視が実際に何をしているか」を読み解いて整理することを得意としています
・障害対応の実務経験から、実際に役立つアラートを見極められます
・担当者が変わっても運用できるよう、ドキュメント化まで対応します
【料金について】
監視対象の規模や現状の複雑さにより、20,000円〜150,000円程度まで幅がございます。まずは無料のお見積り相談にて、現状をお聞かせください。調査のみのご依頼も承ります。
まずはお気軽にご相談ください。「何が問題かも分からない」という状態からで構いません。
ご購入前に、下記についてご確認をお願いいたします。
【事前に伺いたい内容】
・現在ご利用の監視ツールとバージョン(Zabbix、Prometheus等)
・監視対象のサーバー台数、OS
・クラウド(AWS等)/オンプレミスの別
・現在お困りの内容(アラートが多い、誰も触れない 等)
・サーバーおよび監視ツールへのアクセス権限をご提供いただけるか
【作業について】
・作業は主に平日の朝・夜間および土日に行います。お打ち合わせもご都合に合わせて日程調整いたします。
・ご連絡は平日日中も随時確認しております。
・既存設定の変更を伴うため、作業前に必ず現状のバックアップを取得し、変更内容を事前にご共有します。
【ご注意】
・現状の設定が複雑な場合、調査に想定以上のお時間をいただくことがあります。その際は事前にご相談いたします。
・監視ツールのバージョンが古い場合、アップグレードが必要になることがあります。事前の相談で確認いたします。
ご不明点は、購入前の見積り・ご相談からお気軽にお問い合わせください。