section6_問題集

Section 6: 運用卓越性 — 問題集(20 問)

対象範囲: Section 6 (~12.5%) — Ensuring solution and operations excellence 総問題数: 20 問 想定所要時間: 60 分(1 問 3 分目安)


学習方針

正答率の目安

正答率 評価 次のアクション
90% 以上 合格圏(試験本番でも安定) 模擬試験 → 直前は要点と暗記のみループ
75–89% 合格安全圏未到達 弱点別復習ガイド(巻末)で重点強化
60–74% 要対策 02_応用.md を再読 → Section 5 と紐付け
60% 未満 不合格圏 01_基礎.md から学び直し

問題 1 (難易度: ★)

シナリオ: Altostrat Media は動画配信サービスを運営しています。プロダクトリードが「SLO ベースの信頼性管理を導入したい」と提案しました。SRE チームは SLI / SLO / SLA の違いを正しく理解した上で設計を始める必要があります。

質問: SLI / SLO / SLA の違いとして 最も正確な記述 はどれですか。

選択肢:

解答と解説

正解: B

解説:

ひっかけポイント: SLO > SLA(内部目標は契約より厳しく設定する)が原則。SLI < SLO の場合、エラーバジェットを消費しています。

関連リソース:


問題 2 (難易度: ★★)

シナリオ: あなたは SRE として、API サービスの SLO を 99.9% に設定しています。月間運用時間ベースで、SLO に従う場合に許容される エラーバジェット(月あたりのダウンタイム) を計算しています。

質問: SLO 99.9% における月間エラーバジェットの数値はどれですか。

選択肢:

解答と解説

正解: B

解説:

ひっかけポイント: SLO 別エラーバジェットの数値は 暗記必須: 99% = 7h18m、99.5% = 3h39m、99.9% = 43m12s、99.99% = 4m19s、99.999% = 25.9s。

関連リソース:


問題 3 (難易度: ★★)

シナリオ: Cymbal Retail はマルチクラウド戦略で、AWS と GCP の両方で Prometheus メトリクスを収集していました。GCP 内で OSS Prometheus 互換のメトリクス管理を採用し、自動スケール・長期保存・PromQL クエリ を実現したいと考えています。運用負荷を最小化する選択肢を求めています。

質問: この要件に最適な GCP サービスはどれですか。

選択肢:

解答と解説

正解: B

解説:

ひっかけポイント: 2025 改訂で Managed Service for Prometheus が試験範囲に明示追加されました。「PromQL / 24 ヶ月保持 / 自動スケール」のキーワードでは即答できることが大切です。

関連リソース:


問題 4 (難易度: ★★★)

シナリオ: あなたは SRE として、ユーザー体験を悪化させる前に問題を検知する効果的なアラートを設計したいと考えています。一般的な「CPU 80% アラート」は誤検知が多く、運用チームのアラート疲れを引き起こしていました。SLO ベースのアラート戦略を導入する方針です。

質問: Multi-window / Multi-burn-rate アラートの推奨設定として 適切な記述を 2 つ 選びなさい。

選択肢:

解答と解説

正解: A, B

解説:

ひっかけポイント: SRE 推奨は Fast (5min × 14.4x) / Medium (1h × 6x) / Slow (6h × 1x) の 3 段階。CPU % のような静的しきい値は Anti-pattern。

関連リソース:


問題 5 (難易度: ★★)

シナリオ: KnightMotives Automotive はテレマティクス基盤を運営しています。クォータ枯渇に至る前に 予測ベース で警告したいと考えています。例えば「現在のペースなら 7 日後にクォータ枯渇」のようなプロアクティブな通知が必要です。

質問: この要件に最適な Cloud Monitoring の機能はどれですか。

選択肢:

解答と解説

正解: C

解説:

ひっかけポイント: 「プロアクティブ予測」キーワードでは Forecast Alert 一択。2025 試験範囲新規追加項目。

関連リソース:


問題 6 (難易度: ★★)

シナリオ: EHR Healthcare は医療情報を扱う SaaS で、HIPAA コンプライアンス要件があります。ユーザーが患者情報にアクセスした全イベントを記録・保持する必要があります。デフォルトでは特定のログタイプが無効になっているため、明示的な有効化が必要です。

質問: HIPAA コンプライアンスのために有効化すべき GCP の Audit Logs はどれですか。

選択肢:

解答と解説

正解: B

解説:

ひっかけポイント: Audit Logs 4 種を覚える: Admin Activity / Data Access(デフォルト無効)/ System Event / Policy Denied。「データアクセス記録」「コンプラ」キーワードでは即答。

関連リソース:


問題 7 (難易度: ★★★)

シナリオ: Cymbal Retail は大規模 EC サイトで、Black Friday の負荷を事前検証する必要があります。実トラフィックの 10 倍を模擬し、API レスポンスの分布・エラー率・スループットを測定したいと考えています。

質問: この用途に 最も適切な ツール選択肢はどれですか。

選択肢:

解答と解説

正解: A

解説:

ひっかけポイント: 信頼性検証の種類を区別: Load Test(性能)/ Chaos(回復力)/ Pentest(セキュリティ)/ Game Day(演習)。「実トラフィック模擬」= Load Test。

関連リソース:


問題 8 (難易度: ★★)

シナリオ: あなたは SRE として、本番環境で稼働するシステムの 回復力(resilience) を検証したいと考えています。実際にネットワーク遅延・Pod 削除・リージョン障害を意図的に注入し、システムが SLO を維持できるかを継続的にテストする方針です。

質問: この用途に最適な手法はどれですか。

選択肢:

解答と解説

正解: B

解説:

ひっかけポイント: Chaos Engineering の 4 原則: 1. 定常状態の仮説(SLO 達成)2. 現実世界の事象を変数化 3. 本番(または近い環境)で実験 4. 自動化・継続実行

関連リソース:


問題 9 (難易度: ★★)

シナリオ: EHR Healthcare は GCP インフラに対する Pentest(侵入テスト)を計画しています。コンプライアンス要件で年 1 回の Pentest 実施が必要です。あるエンジニアが「GCP で Pentest するには Google への事前申請が必要では?」と尋ねました。

質問: GCP で Pentest を実施する際の 正しい取り扱い はどれですか。

選択肢:

解答と解説

正解: B

解説:

ひっかけポイント: GCP は他クラウドと違って Pentest 事前申請不要。試験では「事前申請が必要」という誤った選択肢で誘導してくる可能性あり。

関連リソース:


問題 10 (難易度: ★★★)

シナリオ: Altostrat Media は本番障害発生時のインシデント対応プロセスを整備しています。ICS(Incident Command System)に基づき役割を明確化したいと考えています。重大障害時に 全体統率と最終判断 を担う中心人物を決める必要があります。

質問: ICS において全体統率・最終判断を担う役割はどれですか。

選択肢:

解答と解説

正解: C

解説:

ひっかけポイント: ICS の 5 役割を覚える: IC(統率)/ Communication(連絡)/ Operations(修復)/ Scribe(記録)/ SME(専門家)

関連リソース:


問題 11 (難易度: ★★)

シナリオ: あなたは複雑な分散システムのパフォーマンス問題を調査中。リクエストが API → Cloud Run → Cloud SQL → Pub/Sub → Worker と流れる中で、どこにレイテンシが集中しているかを可視化したいと考えています。OpenTelemetry 標準対応のサービスを希望しています。

質問: この用途に最適な GCP サービスはどれですか。

選択肢:

解答と解説

正解: C

解説:

ひっかけポイント: Observability の 4 大柱: Logging(ログ)/ Monitoring(メトリクス)/ Trace(分散トレース)/ Profiler(プロファイル)。「サービス間のリクエスト経路」= Trace。

関連リソース:


問題 12 (難易度: ★★)

シナリオ: あなたは本番サービスでメモリ使用量が徐々に増加する問題を調査中。コードのどの関数がメモリリークを引き起こしているかを 本番環境で軽量に 特定したいと考えています。性能影響なく継続的にプロファイル収集する手段を求めています。

質問: この用途に最適な GCP サービスはどれですか。

選択肢:

解答と解説

正解: B

解説:

ひっかけポイント: 「本番常時プロファイル」= Cloud Profiler。本番影響が軽量という特徴が頻出。

関連リソース:


問題 13 (難易度: ★★)

シナリオ: KnightMotives Automotive は組織全体(複数プロジェクト・複数フォルダ)のログを SIEM システムに集約する必要があります。各プロジェクトで個別にログシンクを設定するのは運用負荷が大きいため、組織レベルでまとめて設定したいと考えています。

質問: この要件に最適な GCP 機能はどれですか。

選択肢:

解答と解説

正解: A

解説:

ひっかけポイント: 「組織横断ログ集約」= Aggregated Sink。シンク先は BigQuery / GCS / Pub/Sub / 別 Log Bucket / 外部 SIEM が選べます。

関連リソース:


問題 14 (難易度: ★★★)

シナリオ: EHR Healthcare で本番障害が発生しました。複数のサービス(GKE / Cloud Run / Cloud SQL / Pub/Sub)にまたがる障害で、原因特定が困難です。SRE は AI 支援を使って、リソース横断で関連事象を分析し、原因仮説を生成したいと考えています。

質問: この用途に最適な GCP の AI 機能はどれですか。

選択肢:

解答と解説

正解: C

解説:

ひっかけポイント: 「障害分析 AI 支援」= Gemini Cloud Assist Investigations。Code Assist(IDE)と Cloud Assist(運用)の混同に注意。

関連リソース:


問題 15 (難易度: ★★)

シナリオ: あなたは本番運用チームのリードで、変更管理をしっかり行うため Cloud Deploy を導入しました。次に、コードを変更せずに機能の ON/OFF を切替できる仕組みが必要です。例えば「30% のユーザーにのみ新機能を有効化」「障害発生時に該当機能だけ即時停止」を実現したいと考えています。

質問: この要件に最適な仕組みはどれですか。

選択肢:

解答と解説

正解: C

解説:

ひっかけポイント: 「コード変更なし機能切替」= Feature Flag。デプロイ戦略(Blue-Green / Canary)とは別概念。Progressive Delivery では両者を組み合わせます。

関連リソース:


問題 16 (難易度: ★★)

シナリオ: EHR Healthcare は医療データを扱うため、HIPAA / FedRAMP / IL4 などの規制業界要件を満たす必要があります。GCP 環境を規制業界向けに統制し、機密データのアクセス・処理を強制管理する仕組みを導入したいと考えています。

質問: この要件に最適な GCP サービスはどれですか。

選択肢:

解答と解説

正解: B

解説:

ひっかけポイント: 「規制業界(HIPAA / FedRAMP / IL4)」キーワードでは Assured Workloads 一択。

関連リソース:


問題 17 (難易度: ★★)

シナリオ: あなたは GKE クラスタを運用しており、開発者が誤って不正な K8s リソース(特権 Pod、未承認 Image など)をデプロイするのを防ぎたいと考えています。OPA(Open Policy Agent)/ Gatekeeper ベースのポリシー強制を導入する方針です。

質問: GCP で K8s リソースのポリシー強制に最適なサービスはどれですか。

選択肢:

解答と解説

正解: B

解説:

ひっかけポイント: ポリシー強制の使い分け: Organization Policy(GCP リソース)/ Policy Controller(K8s リソース)。両者を混同しないこと。

関連リソース:


問題 18 (難易度: ★★★)

シナリオ: Cymbal Retail は本番障害発生後の Postmortem を実施しました。SRE リードは「次回の障害を未然に防ぐため、過去 5 件の障害事例から運用ランブックを自動生成したい」と考えています。AI 支援で人手作業を減らす方針です。

質問: この用途に最適な機能はどれですか。

選択肢:

解答と解説

正解: A

解説:

ひっかけポイント: Gemini Cloud Assist の機能は Investigations / Log + Gemini / Alert Summarization / Runbook 生成 の 4 つを覚える。

関連リソース:


問題 19 (難易度: ★★)

シナリオ: あなたは SRE として、運用工数の削減を目指しています。Google SRE Book を参考に、開発者がコードを書くべき時間を確保するために、繰り返し性のある手作業(Toil)を削減したいと考えています。

質問: Google SRE が推奨する Toil の許容上限はどれですか。

選択肢:

解答と解説

正解: B

解説:

ひっかけポイント: Toil 50% の数値は 暗記必須。SRE と通常の Ops の違いを表す重要指標。

関連リソース:


問題 20 (難易度: ★★★)

シナリオ: KnightMotives Automotive は本番アラート疲れに悩まされています。1 日 500 件以上のアラートが Slack に流れ、本当に重要なものが埋もれてしまいます。SRE リードとして、効果的なアラート戦略を組み立て直す必要があります。Google SRE ベストプラクティスに準拠した設計を求められています。

質問: 良いアラート設計の原則として 適切な記述を 3 つ 選びなさい。

選択肢:

解答と解説

正解: A, B, C

解説:

ひっかけポイント: 良いアラート 3 原則: 症状ベース / アクション可能 / SLO Burn Rate。Anti-pattern: 静的しきい値、全 Critical、原因ベース。

関連リソース:


正答率早見表

問題 難易度 主トピック 正解
1 SLI/SLO/SLA 定義 B
2 ★★ エラーバジェット計算 B
3 ★★ Managed Prometheus B
4 ★★★ Multi-burn-rate Alert A, B
5 ★★ Forecast Alert C
6 ★★ Data Access Audit Logs B
7 ★★★ Load Test A
8 ★★ Chaos Engineering B
9 ★★ Pentest(GCP 規約) B
10 ★★★ ICS - IC 役割 C
11 ★★ Cloud Trace C
12 ★★ Cloud Profiler B
13 ★★ Aggregated Sink A
14 ★★★ Gemini Cloud Assist Investigations C
15 ★★ Feature Flag C
16 ★★ Assured Workloads B
17 ★★ Policy Controller B
18 ★★★ Gemini Runbook 生成 A
19 ★★ Toil 50% B
20 ★★★ 良いアラート 3 原則 A, B, C

弱点別復習ガイド

正答率が低かった分野に応じて、以下の学習資料に戻ってください。

弱点分野 関連問題 復習リソース
SLO / SLI / SLA / エラーバジェット 1, 2, 19 ../02_学習資料/06_運用卓越性/02_応用.md §「SRE 用語」「エラーバジェット」
Observability(Monitoring / Logging / Trace / Profiler) 3, 11, 12, 13 ../02_学習資料/06_運用卓越性/02_応用.md §「Observability 4 大柱」「Managed Prometheus」
アラート戦略(Multi-burn / Forecast) 4, 5, 20 ../02_学習資料/06_運用卓越性/02_応用.md §「アラート戦略」
Audit Logs / コンプラ 6, 13, 16 ../02_学習資料/06_運用卓越性/02_応用.md §「Audit Logs」「Assured Workloads」
信頼性検証(Load / Chaos / Pentest) 7, 8, 9 ../02_学習資料/06_運用卓越性/02_応用.md §「Chaos Engineering」「Load Test」「Pentest」
インシデント対応(ICS) 10 ../02_学習資料/06_運用卓越性/02_応用.md §「Incident Command System」
デプロイ管理(Feature Flag / Approval) 15 ../02_学習資料/06_運用卓越性/02_応用.md §「デプロイ戦略」「Cloud Deploy」
ポリシー強制(Policy Controller / Org Policy) 16, 17 ../02_学習資料/06_運用卓越性/02_応用.md §「Policy Controller」「Organization Policy」
Gemini Cloud Assist(運用 AI) 14, 18 ../02_学習資料/06_運用卓越性/02_応用.md §「Gemini Cloud Assist」

推奨復習サイクル

  1. 誤答した問題のみを翌日に再演(メタ認知の強化)
  2. 3 日後に全 20 問を再演(記憶定着確認)
  3. 1 週間後に模擬試験で総合演習../04_模擬試験/ 配下

3 セクション問題集完了 → 全 60 問の総合復習後、../04_模擬試験/ で本番形式 50 問演習へ進む。