インフラ
監視は監視対象の外に置く — セルフホストCIの死活監視をGitHub Actionsで担保する

ローカル1台のセルフホストCIはホストごと落ちると自己検知できない。常時稼働のGitHub Actionsから死活監視・SLO計測・config drift検出を外付けする設計を解説します。

続きを読む
生成AI
Hermes Agent × Slack Socket Mode でローカル常駐 AI 監視エージェントを構築する

Hermes Agent と Slack Socket Mode を組み合わせて、公開 URL 不要でローカル PC に常駐する AI 監視エージェントを構築する方法を解説します。LiteLLM Proxy の4段フォールバック、CI 失敗分析スキル、セキュリティ設計まで。

続きを読む
インフラ
Cloudflare R2 の使用量を Workers cron で監視する——4段階ステートマシンと grace period の設計

Cloudflare R2の容量上限到達によるアップロード停止事故を防ぐため、Workers cronで利用量を監視。4段階ステートマシンとgrace periodの設計により、閾値通知から新規アップロード拒否までを自動化する勘所を解説する。

続きを読む
マイクロサービス
マイクロサービスアーキテクチャの可観測性とOpenTelemetry

OpenTelemetryを活用したマイクロサービスの可観測性向上ガイド。トレーシングやログ、メトリクスの統合でシステム運用を効率化し、信頼性を高める方法を詳しく解説します。

続きを読む