🔧 ロードマップ — 中堅エンジニア向け(8週間)
対象:実務3〜5年 / クラウド(GCP/AWS/Azureいずれか)の実務経験あり 前提:SQL・基本的なデータ処理・クラウドの基礎概念を理解している 学習時間の目安:1日1.5〜2時間 × 週5日(週8〜10時間 × 8週 ≒ 70〜80時間)
中堅は概念は既知のはず。GCP固有のサービス仕様と選定の判断軸にフォーカスし、📘は流し読み・🔧を精読します。AWS/Azure経験者は「対応サービスの読み替え」を意識すると速い。
全体スケジュール
| 週 | テーマ | 主な教材 | アウトプット |
|---|---|---|---|
| 1 | セクション2:取り込みと処理(最重要) | 学習資料2(基礎→応用) | 問題集2 |
| 2 | セクション3:データの保存 | 学習資料3 | 問題集3 |
| 3 | セクション1:システム設計(セキュリティ/移行) | 学習資料1 | 問題集1 |
| 4 | セクション5:保守と自動化 | 学習資料5 | 問題集5 |
| 5 | セクション4:分析準備(BI/ML/共有) | 学習資料4 | 問題集4 |
| 6 | 横断復習:意思決定ツリー+トレードオフ | 全学習資料の🔧 + 用語集 | 誤答ノート作成 |
| 7 | 模擬試験1 → 弱点分析 → 補強 | 模擬試験1 | 70%目標 |
| 8 | 模擬試験2 → 最終調整 → 受験 | 模擬試験2 | 受験 |
週ごとの詳細
Week 1:パイプライン(25%・最優先)
- Dataflow(Apache Beam)のウィンドウ・ウォーターマーク・トリガーを完全理解
- Dataflow / Dataproc / Data Fusion / Pub/Sub の選定基準
- バッチ/ストリーミングのテンプレート、CDC(Datastream)
- 🔧重点:「ストリーミングで遅延データをどう扱うか」「Exactly-once処理」
- ハンズオン:Dataflowテンプレートでストリーミングパイプラインを1本
Week 2:ストレージ(20%)
- 意思決定ツリー(OLTP/OLAP × 構造化度 × スケール × 整合性)を暗記
- BigQuery設計:パーティション・クラスタリング・非正規化・スロット
- Bigtable(行キー設計)vs Spanner(グローバル分散RDB)vs AlloyDB
- 🔧重点:「Bigtableの行キー設計のアンチパターン(ホットスポット)」
Week 3:設計・セキュリティ・移行(22%)
- IAM(事前定義/カスタムロール、最小権限)、VPC Service Controls
- 暗号化(Google管理 / CMEK / CSEK)、Cloud KMS、DLP
- 移行サービスの使い分け(DMS / Datastream / Transfer Appliance / BQ DTS)
- 🔧重点:「データ主権・コンプライアンス要件への対応」
Week 4:保守・運用(18%)
- Cloud Composer(DAG設計)vs Workflows
- BigQuery Editions / スロット予約 / オンデマンドのコスト比較
- 監視(Cloud Monitoring / Logging / INFORMATION_SCHEMA)
- 耐障害性(HA構成、マルチリージョン、タイムトラベル)
Week 5:分析準備(15%)
- BI Engine / マテリアライズドビュー / 承認済みビュー
- BigQuery ML(モデル種別と用途)、Vertex AI連携
- Analytics Hub(組織間共有)、行/列レベルセキュリティ、ポリシータグ
Week 6:横断統合
- 意思決定ツリーを白紙から再現できるか確認
- サービス比較表(処理系・ストレージ系)を自作
- 誤答ノートを作り、間違えたパターンを言語化
Week 7〜8:模試
- 本番同様2時間で模試を実施
- セクション別の正答率を出し、最も低いセクションを集中補強
- 安定して70%を超えたら受験
💡 中堅が狙うべき得点源と注意点
- 得点源:セクション2+3(合計45%)。ここを9割取れれば合格圏が見える
- AWS/Azure経験者の罠:サービスの直訳的な対応に頼ると細部で外す(例:Redshift≠BigQuery、課金/スロットの考え方が異なる)
- やりがちなミス:技術的に可能な選択肢を選んでしまう。PDEは「マネージドで運用負荷最小 / 最もコスト効率が良い」が正解になりやすい
- 時短のコツ:📘は飛ばしてよいが、用語の日英対応だけは用語集で確認