Database Reliability Engineeringに基づくデータベース監視と可観測性の専門スキル。 SQLite/Turso統計情報、スロークエリログ、接続数監視、 ディスク使用量、レプリケーション遅延などの運用メトリクスを提供します。 使用タイミング: - 本番DBの健全性を監視する時 - パフォーマンス劣化を検知する時 - アラート設定を構築する時 - SLI/SLOを設計する時 📚 リソース参照: このスキルには以下のリソースが含まれています。 必要に応じて該当するリソースを参照してください: - `.claude/skills/database-monitoring/resources/alerting-strategies.md`: アクション可能なアラート設計とエスカレーションパターン - `.claude/skills/database-monitoring/resources/health-metrics.md`: 監視すべき主要指標と閾値設計ガイドライン - `.claude/skills/database-monitoring/resour...
Scanned 9/8/2026
Install to Claude Code
npx -y skills add mattnigh/skills_collection --skill collection --agent claude-codeInstalls into .claude/skills of the current project.
Are you the author of Collection?
Add the live security badge to your README — it updates automatically with every re-scan.
[](https://www.skillsdirectory.com/skills/mattnigh-collection-a487dd7c)More formats (shields.io, HTML) on the badges page.
---
name: .claude/skills/database-monitoring/SKILL.md
description: |
Database Reliability Engineeringに基づくデータベース監視と可観測性の専門スキル。
SQLite/Turso統計情報、スロークエリログ、接続数監視、
ディスク使用量、レプリケーション遅延などの運用メトリクスを提供します。
使用タイミング:
- 本番DBの健全性を監視する時
- パフォーマンス劣化を検知する時
- アラート設定を構築する時
- SLI/SLOを設計する時
📚 リソース参照:
このスキルには以下のリソースが含まれています。
必要に応じて該当するリソースを参照してください:
- `.claude/skills/database-monitoring/resources/alerting-strategies.md`: アクション可能なアラート設計とエスカレーションパターン
- `.claude/skills/database-monitoring/resources/health-metrics.md`: 監視すべき主要指標と閾値設計ガイドライン
- `.claude/skills/database-monitoring/resources/sqlite-statistics.md`: SQLite/Turso統計情報の活用とクエリパターン
- `.claude/skills/database-monitoring/resources/slow-query-logging.md`: スロークエリログ設定と分析手法
- `.claude/skills/database-monitoring/templates/alert-rules-template.md`: アラートルール定義テンプレート
- `.claude/skills/database-monitoring/templates/monitoring-dashboard-template.md`: Grafanaダッシュボード設計テンプレート
- `.claude/skills/database-monitoring/scripts/connection-stats.mjs`: 接続数統計収集スクリプト
- `.claude/skills/database-monitoring/scripts/health-check.mjs`: データベース健全性チェックスクリプト
Use proactively when implementing .claude/skills/database-monitoring/SKILL.md patterns or solving related problems.
version: 1.0.0
---
# Database Monitoring スキル
## 概要
Database Reliability Engineering の原則に基づき、SQLite/Tursoデータベースの
健全性監視、パフォーマンス追跡、アラート設計を体系化したスキルです。
### このスキルが提供するもの
| カテゴリ | 内容 |
| -------------------- | -------------------------------------- |
| 統計情報活用 | PRAGMA統計とsqlite_stat テーブルの活用 |
| スロークエリ監視 | ログ設定、分析、最適化トリガー |
| 健全性メトリクス | 監視すべき主要指標と閾値設計 |
| アラート設計 | アクション可能なアラートルール |
| プラットフォーム固有 | Turso の監視機能活用 |
## ワークフロー
### Phase 1: 監視要件の定義
**目的**: 何を監視すべきかを明確化
**実行内容**:
1. ビジネス要件からSLI/SLOを導出
2. 重要なデータベース操作を特定
3. 監視対象メトリクスを選定
4. アラート閾値の初期設定
**完了条件**:
- [ ] SLI(Service Level Indicators)が定義されている
- [ ] 監視対象メトリクスリストが作成されている
- [ ] アラート優先度が分類されている
### Phase 2: メトリクス収集の設定
**目的**: SQLite/Turso統計情報を活用した監視基盤構築
**実行内容**:
1. クエリログの有効化(アプリケーションレベル)
2. スロークエリログの設定
3. 統計情報収集間隔の最適化
4. メトリクスエクスポーターの設定(必要に応じて)
**重要な統計情報源**:
| 情報源 | 用途 |
| -------------------- | ------------------------ |
| PRAGMA database_list | データベース接続状態 |
| PRAGMA table_info | テーブル構造とメタデータ |
| PRAGMA index_list | インデックス一覧 |
| sqlite_stat1/stat4 | クエリプランナー統計 |
| PRAGMA page_count | データベースサイズ統計 |
**完了条件**:
- [ ] クエリログが有効化されている
- [ ] スロークエリログが設定されている
- [ ] 主要PRAGMA統計へのクエリが準備されている
### Phase 3: アラート設計
**目的**: アクション可能なアラートを構築
**アラートレベル定義**:
| レベル | 条件 | 対応 |
| -------- | -------------------------------- | -------------------- |
| Critical | データ損失リスク、サービス停止 | 即座にオンコール対応 |
| Warning | パフォーマンス劣化、リソース逼迫 | 営業時間内に対応 |
| Info | 傾向変化、注意喚起 | 次回スプリントで検討 |
**主要アラートパターン**:
1. **接続数アラート**
- Warning: 最大接続数の 80% 超過
- Critical: 最大接続数の 95% 超過
2. **スロークエリアラート**
- Warning: 5秒超クエリが 10件/分
- Critical: 30秒超クエリが発生
3. **ディスク使用量アラート**
- Warning: 80% 使用
- Critical: 90% 使用
4. **レプリケーション遅延**
- Warning: 10秒以上の遅延
- Critical: 60秒以上の遅延
**完了条件**:
- [ ] アラートルールが定義されている
- [ ] 通知ルーティングが設定されている
- [ ] エスカレーションパスが明確
### Phase 4: ダッシュボード構築
**目的**: 可視化による運用効率化
**推奨ダッシュボードパネル**:
1. **概要パネル**
- データベースサイズ
- 接続数(現在/最大)
- トランザクション数/秒
2. **パフォーマンスパネル**
- クエリ実行時間分布
- スロークエリ件数推移
- キャッシュヒット率
3. **リソースパネル**
- ディスクI/O
- メモリ使用量
- CPU使用率
4. **エラーパネル**
- デッドロック発生
- 接続エラー
- タイムアウト
**完了条件**:
- [ ] ダッシュボードが構築されている
- [ ] リフレッシュ間隔が適切
- [ ] 関係者がアクセス可能
## ベストプラクティス
### 監視設計の原則
1. **アクション可能なアラートのみ**
- アラートは対応アクションが明確なもののみ
- Alert Fatigue(アラート疲れ)を防ぐ
2. **段階的な閾値設定**
- いきなりCriticalではなくWarningから
- 対応時間を確保できる設計
3. **コンテキストの付与**
- アラートにはクエリ例や影響範囲を含める
- 対応手順へのリンクを含める
4. **定期的なレビュー**
- 月次でアラート発火頻度を分析
- 閾値の調整とルールの整理
### Turso 固有の考慮事項
**Turso**:
- libSQL HTTP接続とWebSocketの監視
- エッジロケーション別のレイテンシ追跡
- レプリケーション遅延の監視
- データベースブランチ間の同期状態確認
- 読み取り専用レプリカの負荷分散状況
## チェックリスト
### 監視設定時
- [ ] クエリログが有効か?
- [ ] スロークエリログの閾値は適切か?
- [ ] 接続数の上限監視があるか?
- [ ] ディスク使用量監視があるか?
### アラート設計時
- [ ] アラートにアクション定義があるか?
- [ ] エスカレーションパスが明確か?
- [ ] 重複アラートの抑制があるか?
- [ ] テスト環境でアラートテストしたか?
### 運用時
- [ ] ダッシュボードを定期確認しているか?
- [ ] アラート発火時の対応が迅速か?
- [ ] 月次でメトリクス傾向をレビューしているか?
- [ ] 閾値の調整を行っているか?
## リソース参照
詳細な知識が必要な場合:
```bash
# SQLite/Turso統計情報の詳細
cat .claude/skills/database-monitoring/resources/sqlite-statistics.md
# スロークエリログの設定と分析
cat .claude/skills/database-monitoring/resources/slow-query-logging.md
# 健全性メトリクスと閾値設計
cat .claude/skills/database-monitoring/resources/health-metrics.md
# アラート設計パターン
cat .claude/skills/database-monitoring/resources/alerting-strategies.md
```
## スクリプト
```bash
# DB健全性チェック
node .claude/skills/database-monitoring/scripts/health-check.mjs
# 接続数統計収集
node .claude/skills/database-monitoring/scripts/connection-stats.mjs
```
## テンプレート
```bash
# Grafanaダッシュボード設計テンプレート
cat .claude/skills/database-monitoring/templates/monitoring-dashboard-template.md
# アラートルール設計テンプレート
cat .claude/skills/database-monitoring/templates/alert-rules-template.md
```
## 関連スキル
| スキル | 関係性 |
| ------------------------ | -------------------------- |
| .claude/skills/query-performance-tuning/SKILL.md | スロークエリ検出後の最適化 |
| .claude/skills/backup-recovery/SKILL.md | 障害検知時の復旧対応 |
| .claude/skills/connection-pooling/SKILL.md | 接続数問題の解決 |
Is this your skill, or is something wrong with this listing? Request removal or report an issue. Author removals are honored within 72 hours.
No comments yet. Be the first to comment!