● 24/7 INCIDENT MONITORING
Kurageさんが、障害を見つけて、調べて、報告する。
Kurage Zabbixは、Zabbixが検知した障害をKurageさん(ローカルLLM)が自動で調査する監視システムです。証拠収集からログ解析、原因候補の特定、推奨対応まで——人が障害対応で最初にやる仕事を、検知から数分でレポートにまとめて届けます。
⏱ 検知から数分でレポート
🔒 ログは外部に出さない
✉ メール + 限定ブログ
仕組み — 検知から報告まで全自動
既存のZabbix Serverをそのまま監視の正として使い、障害イベントをフックにAI調査パイプラインが走ります。
📡
Zabbixが検知
トリガー・ログ監視(log/logrt)・SNMPトラップで24時間365日監視。障害イベントがWebhookでKurage Zabbixへ届きます。
🔍
証拠を収集
Zabbix APIからイベント・関連ログ・メトリクスの生データを自動収集。調査に必要な一次証拠を揃えます。
🧠
Kurageさんが調査
ローカルLLM(Gemma4 12B)が証拠を読み、概要・時系列・ログ解析・原因候補と確度・推奨対応を導きます。機密ログは外部APIに送りません。
📮
レポートを配信
同一のレポートをメール通知と限定ブログへ同時配信。障害の記録が検索できるナレッジとして蓄積されます。
8セクションの調査レポート
毎回同じ構造で書かれるので、深夜のアラートでも読む場所が決まっています。
RESOLVED
[web-01] HTTP service is down
◎ 概要⚑ 影響範囲⏱ 時系列☰ 観測事実
⌗ ログ解析⚙ 原因候補と確度✔ 推奨対応+ 追加で必要な証拠
特徴
♻️
既存Zabbixをそのまま活用
監視基盤の入れ替え不要。動いているZabbix Server 7.0にWebhookを1本足すだけで導入できます。
🔒
ログを外部に出さない
調査はローカルGPU上のGemma4で完結。障害ログや構成情報がクラウドLLMへ送信されることはありません。
📚
障害ナレッジが貯まる
レポートはX認証つきの限定ブログに時系列で蓄積。過去の類似障害をいつでも振り返れます。
🧩
OSSで構成
ブログはBludit(MIT)をvendor固定。Zabbix・rsyslog・Net-SNMPなど実績あるOSSの上に薄く乗る設計です。
スタック
Zabbix 7.0Gemma4 12B (ローカルLLM)FastAPIBluditSNMP / rsyslogX認証(限定閲覧)