📺 Production Monitoring with Codex: Grafana, Kubernetes, & Security
Codexとカスタムスキルを使い、監視情報やコード、デプロイ状況を集めて本番障害の原因調査と修正案の作成を支援する方法を紹介します。決済エラー、Kubernetesの障害、過剰なリクエストによる負荷という3つの事例を通じて、人間の承認を含む運用フローを取り上げます。
- 決済エラー:監視ダッシュボード、リリース情報、コードを使った調査と修正
- Kubernetes:コンテナの異常終了とクラスターへの影響、ロールアウト調査
- セキュリティとの連携:高負荷リクエストを制限する対応
- 自動化の選択肢:セルフホスト型ランナーや複数エージェントの活用例
本番運用やSRE、開発に携わる方に向けた内容です。紹介される各事例を参考に、自身の監視環境や承認手順に適用できる範囲を確認し、障害対応の自動化を検討できます。
この動画を紹介した OpenAI の最新動画も、紹介付きで読めます。
📄 このページの紹介文は AI が独自に生成したものであり、著作権をはじめとする他者の権利(商標権・名誉権・プライバシー等)を侵害しないよう配慮しています。動画の著作権は各作成者に帰属します。