Section 6: ソリューションと運用の卓越性の確保(~12.5%)
Well-Architected Framework の Operational Excellence(運用上の卓越性)を中心に、Cloud Observability(Monitoring/Logging/Trace/Profiler)、SRE プラクティス(SLI/SLO/SLA/エラーバジェット)、リリース管理、信頼性検証(Chaos / Pentest / Load Test)を体系的に学ぶ。
このセクションのゴール
- Well-Architected Operational Excellence Pillar の原則を即答できる
- Cloud Observability の 4 大柱(Monitoring / Logging / Trace / Profiler)と Error Reporting を使い分けられる
- SLI / SLO / SLA / エラーバジェット を設計できる
- アラート戦略(症状ベース、Multi-window/Multi-burn-rate、ノイズ削減)を語れる
- デプロイ・リリース管理(Blue-Green / Canary / Feature Flag / GitOps)の正しい選び方を持つ
- 本番サポート(インシデント対応、Postmortem、ランブック)の進め方を理解
- 品質管理(コードレビュー、変更管理、コンプライアンス監査)を語れる
- 信頼性検証(Chaos Engineering、Load Test、Pentest)を実施計画できる
公式試験ガイドのカバー範囲
| 小項目 | テーマ |
|---|---|
| 6.1 | Well-Architected の Operational Excellence Pillar |
| 6.2 | Google Cloud Observability(Monitoring/Logging、Profiling/Benchmarking、Alerting) |
| 6.3 | デプロイ・リリース管理 |
| 6.4 | デプロイ済みソリューションのサポート |
| 6.5 | 品質管理の評価 |
| 6.6 | 本番運用の信頼性確保(Chaos Engineering、Pentest、Load Test) |
ファイル構成
| ファイル | 対象 | 内容 |
|---|---|---|
01_基礎.md |
📘 新人 | Observability、SLO の基本、デプロイ戦略、インシデント対応 |
02_応用.md |
🔧 中堅 | エラーバジェット運用、Multi-burn-rate アラート、SRE プラクティス、Chaos / Pentest 設計 |
03_要点と暗記.md |
🎯 シニア / 直前確認 | 即答すべき SLI/SLO 設計、アラート戦略、Observability ツール選定 |
学習の進め方
新人(実務 1-2 年)
01_基礎.mdを通読(1.5-2 時間)- Cloud Monitoring で実際にダッシュボード・アラートを作る
02_応用.mdを流し読み(1 時間)- SLO を 1 つ自分のサービスに設定してみる
03_要点と暗記.mdで要点整理
中堅(実務 3-5 年)
01_基礎.mdは目次だけ02_応用.mdを精読(SRE プラクティス、Chaos、Pentest)03_要点と暗記.mdで 暗記必須項目 を確認- 演習で 80% 以上
シニア
03_要点と暗記.mdから開始(20-30 分)- 未知/最新項目 のみ
02_応用.mdで確認 - 演習で 85% 以上
重要キーワード(Section 6)
| カテゴリ | キーワード |
|---|---|
| Observability | Cloud Monitoring、Cloud Logging、Cloud Trace、Cloud Profiler、Error Reporting、Managed Service for Prometheus |
| SRE | SLI、SLO、SLA、エラーバジェット、Toil、Burn Rate、Multi-window/Multi-burn-rate Alert |
| アラート | Alerting Policies、Notification Channels、Incident、SNOOZE、Forecast Alerts |
| ログ | Log Sinks、Log Buckets、Log-based Metrics、BigQuery 連携、PubSub 連携 |
| トレース | OpenTelemetry、Cloud Trace、Cloud Profiler、APM |
| デプロイ管理 | Blue-Green、Canary、Rolling、Feature Flag、GitOps、Cloud Deploy |
| 信頼性 | RTO、RPO、DR、Chaos Engineering、Game Day、Fault Injection |
| 品質管理 | コードレビュー、Change Management、Audit、Continuous Compliance |
| 検証 | Load Test、Pentest、Security Audit、Compliance Scanning |
| AI 支援 | Gemini Cloud Assist for Observability、Investigations |
Section 6 と他セクションの関係
Section 1(設計) → Reliability Pillar、Operational Excellence Pillar
Section 2(インフラ) → Monitoring/Logging のリソース構成
Section 3(セキュリティ)→ Pentest、Compliance Audit
Section 4(ビジネス) → SLA → ビジネス要件
Section 5(実装管理) → Cloud Deploy、CI/CD パイプライン
Section 6(運用卓越性)⬅️★ ここ ─ 上記の運用化(観測、SLO、リリース、信頼性検証)
Section 6 は 「運用フェーズ」全般 を扱う。SRE プラクティスを Google Cloud のサービスで実装する観点が試験の中心。