§14
監視・可観測性・運用
最終確認:2026年9月
エラー監視
計装(トレース・メトリクス)
可観測性基盤(コスト重視)
Grafana Cloud(Loki:ログ、Tempo:トレース、Mimir/Prometheus:メトリクス)
- セルフホストのGrafanaスタックオンプレ要件
AWS標準
CloudWatch(ログの一次保管・アラーム)
外形監視・ステータスページ
- UptimeRobot無償で最低限
オンコール・通知
ログ形式
構造化ログ(JSON)
RUM(実ユーザーの表示速度)
Sentry(パフォーマンス機能)
- Vercel Speed InsightsVercel採用時
運用ドキュメント
障害対応手順
リポジトリ内 `docs/runbooks/`
ポストモーテム
テンプレートを決めて `docs/postmortems/` に蓄積
SLO
可用性とレイテンシの2指標から始める