アラート受信後の調査・根本原因分析・復旧方針の提示を自律的に実行するSRE向けインシデント対応プラットフォーム。Datadog、Prometheus、Kubernetes、主要クラウドを含む700以上のインテグレーションに標準対応し、ログ・メトリクス・トレース・デプロイ履歴を横断して原因候補を整理する。調査結果・影響範囲・推奨対応・タイムラインはSlackへ集約され、過去のRCAドキュメントや技術仕様書も文脈として参照できる。月30件のインシデント調査まで無料で利用可能。オンコール対応の工数削減と障害対応プロセスの標準化を目的とした、SRE・DevOps・開発チーム向けのツール。
AIエージェント型SREプラットフォーム。監視ツールからアラート受信 → AIエージェントが自律調査 → 根本原因分析の自動化、復旧の迅速化。月30件まで無料という強気なフリーミアム。PagerDuty/Datadogのカテゴリだが、「SRE業務そのもの」をAI化する設計。
編集部レビューの全文 >

