Better Stackは、稼働状況とインフラストラクチャの監視、インシデント管理、オンコールスケジューリング、エラー追跡、ステータスページを統合したプラットフォームです。AI SREエージェントは、単に障害が発生したことを通知するだけでなく、スマートフォンから直接、その原因究明を支援します。
インシデントアラート
プッシュ通知、SMS、電話、メール、Slack、Teamsメッセージなど、お好みのチャネルでインシデントアラートを受信できます。スマートフォンでワンクリックするだけでインシデントを承認し、チームメンバーに対応中であることを知らせることができます。
インシデントレポート
すべてのインシデントは、スクリーンショット、エラーメッセージ、そして発生した事象を秒単位で記録したタイムラインとともに保存されます。解決したら、簡単な事後分析レポートを作成し、チーム全体で教訓を共有しましょう。
AI SRE
インシデントが発生した場合、一人で調査する必要はありません。AI SREタブをタップすると、エージェントがログ、メトリクス、トレースを分析し、最近のデプロイメントとメトリクスの変更を照合して、根本原因を特定します。修正を含むプルリクエストを作成でき、常に事前に承認を求めます。
オンコールスケジューリング
オンコールローテーションの設定、カバー依頼、オーバーライドの追加が可能です。オンコール担当者が寝てしまった場合でも、応答がない場合はスマートエスカレーション機能により次の担当者、またはチーム全体が自動的に起動します。スケジュールをGoogleカレンダーまたはOutlookと同期することで、全員が担当者のオンコール状況を把握できます。
稼働状況モニタリング
複数のリージョンからの信頼性の高いHTTP(s)およびpingチェックにより、最短30秒間隔で稼働状況を監視できます。
ハートビートモニタリング
CRONスクリプトやバックグラウンドジョブにハートビートモニタリングを使用すれば、データベースバックアップを失う心配はもうありません。
エラー追跡
Sentry互換のエラー追跡機能で、スタック全体の例外を追跡できます。AI SREにエラーの調査を依頼し、エラーを引き起こした変更を特定できます。
ステータスページ
システム障害が発生した場合、チームだけでなく関係者全員が状況を把握する必要があります。ブランドイメージを反映した公開ステータスページを作成して、顧客に最新情報を提供し、製品への信頼を高めましょう。しかも、たった3分で設定完了!
豊富な連携機能
100種類以上のアプリと連携し、あらゆるインフラサービスと接続できます。Heroku、Datadog、New Relic、Grafana、Prometheus、Zendeskなど、多数のツールと同期可能です。
オンコール管理、インシデントアラートの受信、AI SREによる問題解決