Examers.io
ExamsOrganizationsHow it worksPricingHelp & FAQ
GOOGLE CLOUD

Google Cloud Professional Data Engineer

PROFESSIONAL-DATA-ENGINEERProfessional Data Engineer

The Google Cloud Professional Data Engineer certification validates your ability to design, build, and operationalize data processing systems on Google Cloud. It is for data engineers who architect scalable, reliable, and secure data solutions that turn raw data into actionable insights. Earning it demonstrates you can apply Google Cloud technologies to solve real-world data challenges and drive business value.

457 practice questions · Updated 2026-07-30

5Domains
19Objectives
141Concepts
457Questions

PROFESSIONAL-DATA-ENGINEER Curriculum

Every domain, objective, and concept the PROFESSIONAL-DATA-ENGINEER exam measures.

  1. Cloud IAM basics
  2. Organization policies
  3. Encryption at rest and in transit
  4. Key management
  5. Handling PII
  6. Data sovereignty
  7. Regulatory compliance
  8. Data governance architecture
  9. Multi-environment design
  1. Data preparation and cleaning with Dataform
  2. Data preparation and cleaning with Dataflow
  3. Data preparation and cleaning with Cloud Data Fusion
  4. Prompting LLMs for query generation
  5. Monitoring data pipelines
  6. Orchestration of data pipelines
  7. Disaster recovery planning
  8. Fault tolerance in data processing
  9. ACID compliance in data systems
  10. Availability vs. consistency trade-offs
  11. Data validation techniques
  1. Requirements mapping
  2. Architecture flexibility
  3. Portability design
  4. Data residency compliance
  5. Data staging
  6. Data cataloging
  7. Data profiling
  8. Data discovery

1.4 Designing data migrations

12 concepts · 38 questions
  1. Stakeholder and requirements analysis
  2. Current state assessment
  3. Desired state definition
  4. Migration planning and gap analysis
  5. Migration strategy selection
  6. Data migration services overview
  7. BigQuery Data Transfer Service
  8. Database Migration Service
  9. Transfer Appliance
  10. Datastream
  11. Google Cloud networking for migration
  12. Migration validation and testing

2.1 Planning the data pipelines

6 concepts · 19 questions
  1. Identify data sources
  2. Identify data sinks
  3. Define data transformation logic
  4. Define orchestration logic
  5. Apply networking fundamentals
  6. Implement data encryption

2.2 Building the pipelines

10 concepts · 38 questions
  1. Data cleansing techniques
  2. Dataflow and Apache Beam
  3. Dataproc and Hadoop ecosystem
  4. Cloud Data Fusion
  5. BigQuery for data processing
  6. Pub/Sub for streaming ingestion
  7. Apache Spark and Kafka
  8. Data transformations
  9. Data acquisition and import
  10. Integrating new data sources
  1. Cloud Composer basics
  2. DAG authoring in Cloud Composer
  3. Cloud Composer operations
  4. Workflows service
  5. Comparing Composer and Workflows
  6. CI/CD principles for data pipelines
  7. CI/CD tooling on Google Cloud
  8. Pipeline deployment automation
  9. Testing and validation in CI/CD

3.1 Selecting storage systems

12 concepts · 35 questions
  1. Data access pattern analysis
  2. Managed service selection criteria
  3. BigQuery and BigLake use cases
  4. AlloyDB and Cloud SQL use cases
  5. Bigtable and Spanner use cases
  6. Cloud Storage and Firestore use cases
  7. Memorystore use cases
  8. Storage cost estimation
  9. Performance planning for storage
  10. Data lifecycle management
  11. Storage class selection and transitions
  12. Data retention and deletion policies

3.2 Planning for using a data warehouse

7 concepts · 17 questions
  1. Data modeling fundamentals
  2. Designing the data model
  3. Normalization levels
  4. Choosing normalization degree
  5. Mapping business requirements
  6. Data access patterns
  7. Architecture for access patterns

3.3 Using a data lake

3 concepts · 16 questions
  1. Data lake configuration
  2. Data processing in data lake
  3. Data lake monitoring

3.4 Designing for a data platform

6 concepts · 23 questions
  1. Dataplex overview
  2. Dataplex Catalog
  3. Data platform design with BigQuery and Cloud Storage
  4. Federated governance model
  5. Policy management and data access control
  6. Data lineage and metadata management

4.1 Preparing data for visualization

7 concepts · 24 questions
  1. Connecting to visualization tools
  2. Precalculating fields for visualization
  3. BigQuery BI Engine
  4. Materialized views in BigQuery
  5. Troubleshooting poor performing queries
  6. Security and IAM for data access
  7. Data masking and Cloud DLP

4.2 Preparing data for AI and ML

5 concepts · 23 questions
  1. Feature engineering for ML models
  2. BigQuery ML data preparation
  3. Serving data for ML predictions
  4. Embedding generation for unstructured data
  5. Retrieval-augmented generation (RAG) data preparation

4.3 Sharing data

4 concepts · 13 questions
  1. Data sharing rules
  2. Publishing datasets
  3. Publishing reports and visualizations
  4. BigQuery Analytics Hub

5.1 Optimizing resources

5 concepts · 11 questions
  1. Cost optimization strategies for data workloads
  2. Resource allocation for business-critical processes
  3. Persistent vs. job-based clusters
  4. Autoscaling and cluster sizing
  5. Lifecycle management of clusters
  1. DAG fundamentals
  2. DAG authoring in Cloud Composer
  3. Scheduling DAGs
  4. Orchestration best practices
  1. BigQuery Editions
  2. BigQuery Reservations
  3. Slot capacity management
  4. Interactive query jobs
  5. Batch query jobs
  6. Choosing between interactive and batch
  1. Cloud Monitoring for data processes
  2. Cloud Logging for data processes
  3. BigQuery admin panel
  4. Monitoring planned usage
  5. Troubleshooting error messages
  6. Troubleshooting billing issues
  7. Troubleshooting quotas
  8. Managing jobs and queries
  9. Managing compute capacity with reservations
  1. Fault tolerance design principles
  2. Managing restarts and recovery
  3. Multi-region and multi-zone job deployment
  4. Handling data corruption and missing data
  5. Data replication strategies
  6. Failover mechanisms
  7. Cloud SQL high availability and failover
  8. Redis cluster replication and failover
Ready to practice?Test your knowledge with exam-style questions or take an intelligent quiz tailored to your level.

Percentages reflect share of the current practice bank, not official exam weightings — no structured per-skill weight is published for PROFESSIONAL-DATA-ENGINEER, so none is invented.