ArchyntArchynt.api
アラート

ユーザーより先に気づく

Archyntはホストのcpu/RAM、各サービスのエラー率、コンテナのライフサイクルを監視し、何か異常が見られると自動的にアラートを発生させます — 手動でのしきい値設定は不要です。

fe-web-adminContainer stoppedERROROPEN

Container "fe-web-admin" stopped unexpectedly

2 minutes ago

api-gatewayCPU spikeERRORACKED

Host CPU jumped to 91% (was ~38% over the last 30 min)

18 minutes ago

be-user-dataRAM pressureCRITICALOPEN

Host RAM usage at 93% — approaching exhaustion

41 minutes ago

アラートの仕組み

01

CPUスパイク

ホストのCPUが直近の自身のベースラインを大きく超えて短時間で跳ね上がる — 「何かが変わったのに誰も気づいていない」典型的なケースです。

02

CPU / RAMの上昇傾向

過去数週間の同時間帯と比較することで、ゆっくりとしたリークや徐々に増加する負荷が、落ち込みになる前に検出されます。

03

RAM逼迫

ホストのメモリ使用量が枯渇に近づき、OOM killが現実のリスクとなるレベルに達します。

04

エラー率の異常

サービスのエラー率が自身の通常のベースラインから外れます — 固定のグローバルしきい値ではなく自分自身と比較するため、もともとノイズの多いサービスがアラートで溢れることがありません。

05

コンテナ停止

Archyntが実際に観測しているDockerコンテナが予期せず停止します。自分たちが運用していない外部依存(リモートデータベース、マネージドサービスなど)がこのアラートを発生させることはありません。

06

メール + アプリ内通知

アラートが発生した瞬間に組織の全メンバーにメールが届き、加えて受信箱を確認しない人向けにダッシュボードのバッジとトースト通知も表示されます。

07

確認とクローズ

アラートを確認済みにし、その後対応内容を短いコメントとともにクローズします。クローズすることで同じ条件が後で再びアラートを発生できるようになります。