## 14. 監視・可観測性・運用

確認：2026年9月

| 役割 | 既定 | 代替と乗り換え条件 |
|---|---|---|
| エラー監視 | **Sentry** | — |
| 計装（トレース・メトリクス） | **OpenTelemetry** | — |
| 可観測性基盤（コスト重視） | **Grafana Cloud**（Loki：ログ、Tempo：トレース、Mimir/Prometheus：メトリクス） | セルフホストのGrafanaスタック：オンプレ要件 |
| 可観測性基盤（予算あり・一体型） | **Datadog** | New Relic：既存の契約や資産があるとき |
| AWS標準 | **CloudWatch**（ログの一次保管・アラーム） | — |
| 外形監視・ステータスページ | **Better Stack** | UptimeRobot：無償で最低限 |
| オンコール・通知 | **PagerDuty** | incident.io：Slack中心でインシデント対応を回したいとき。小規模ならSlack通知のみ |
| ログ形式 | **構造化ログ（JSON）** | — |
| 負荷試験 | **k6** | Locust：Pythonでシナリオを書きたいとき |
| RUM（実ユーザーの表示速度） | **Sentry（パフォーマンス機能）** | Vercel Speed Insights：Vercel採用時 |

### 運用ドキュメント

| 役割 | 既定 |
|---|---|
| 障害対応手順 | **リポジトリ内 `docs/runbooks/`** |
| ポストモーテム | **テンプレートを決めて `docs/postmortems/` に蓄積** |
| SLO | **可用性とレイテンシの2指標から始める** |
