Szkolenia Google Cloud

Cel szkolenia

kod: G-BBDPGC | wersja: 3.0

In this intermediate course, you will learn to design, build, and optimize robust batch data pipelines on Google Cloud. Moving beyond fundamental data handling, you will explore large-scale data transformations and efficient workflow orchestration, essential for timely business intelligence and critical reporting.

 

Get hands-on practice using Dataflow for Apache Beam and Serverless for Apache Spark (Dataproc Serverless) for implementation, and tackle crucial considerations for data quality, monitoring, and alerting to ensure pipeline reliability and operational excellence. A basic knowledge of data warehousing, ETL/ELT, SQL, Python, and Google Cloud concepts is recommended.

 

What you'll learn

  • Determine whether batch data pipelines are the correct choice for your business use case.
  • Design and build scalable batch data pipelines for high-volume ingestion and transformation.
  • Implement data quality controls within batch pipelines to ensure data integrity.
  • Orchestrate, manage, and monitor batch data pipeline workflows, implementing error handling and observability using logging and monitoring tools.

 

Audience

This course is for:

  • Data Engineers
  • Data Analysts

Plan szkolenia Rozwiń listę

  • When to choose batch data pipelines
    • Topics
      • You will learn the critical role of a data engineer in developing and maintaining batch data pipelines, understand their core components and lifecycle, and analyze common challenges in batch data processing. You'll also identify key Google Cloud services that address these challenges.
    • Objectives
      • Explain the critical role of a data engineer in developing and maintaining batch data pipelines.
      • Describe the core components and typical lifecycle of batch data pipelines from ingestion to downstream consumption.
      • Analyze common challenges in batch data processing, such as data volume, quality, complexity, and reliability, and identify key Google Cloud services that can address them.
  • Design and build batch data pipelines
    • Topics
      • You will design scalable batch data pipelines for high-volume data ingestion and transformation. You'll also optimize batch jobs for high throughput and cost-efficiency using various resource management and performance tuning techniques.
    • Objectives
      • Design scalable batch data pipelines for high-volume data ingestion and transformation.
      • Optimize batch jobs for high throughput and cost-efficiency using various resource management and performance tuning techniques.
  • Control data quality in batch data pipelines
    • Topics
      • You will develop data validation rules and cleansing logic to ensure data quality within batch pipelines. You'll also implement strategies for managing schema evolution and performing data deduplication in large datasets.
    • Objectives
      • Develop data validation rules and cleansing logic to ensure data quality within batch pipelines.
      • Implement strategies for managing schema evolution and performing data deduplication in large datasets.
  • Orchestrate and monitor batch data pipelines
    • Topics
      • You will orchestrate complex batch data pipeline workflows for efficient scheduling and lineage tracking. You'll also implement robust error handling, monitoring, and observability for batch data pipelines.
    • Objectives
      • Orchestrate complex batch data pipeline workflows for efficient scheduling and lineage tracking
      • Implement robust error handling, monitoring, and observability for batch data pipelines
Pobierz konspekt szkolenia w formacie PDF

Dodatkowe informacje

Wymagania wstępne
  • Basic proficiency with Data Warehousing and ETL/ELT concepts
  • Basic proficiency in SQL
  • Basic programming knowledge (Python recommended)
  • Familiarity with gcloud CLI and the Google Cloud console
  • Familiarity with core Google Cloud concepts and services
Poziom trudności
Czas trwania 1 dzień
Certyfikat

The participants will obtain certificates signed by Google Cloud (course completion).

This course is one of the four courses in the series “Data Engineering on Google Cloud” and is intended also to help you prepare for the Google Cloud Professional Data Engineer certification exam. Google Cloud certification exams are offered at Kryterion test centers worldwide. More information about Data Engineer exam https://cloud.google.com/learn/certification/data-engineer/

Prowadzący

Authorized Google Cloud Trainer

Pozostałe szkolenia Google Cloud | Data Engineering

  • konspekt szkolenia: Introduction to Data Engineering on Google Cloud

    Introduction to Data Engineering on Google Cloud szkolenie Google Cloud

    dostępne terminy szkolenia
    cena od: 2500 PLN
    czas: 1 dzień
    poziom trudności: 3 z 6
    kod: GC-IDEGC
    wersja: v1.0
    2026-02-13 | Kraków / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-02-13 | Warszawa / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-03-06 | Kraków / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-03-06 | Warszawa / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-04-03 | Kraków / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-04-03 | Warszawa / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-05-08 | Kraków / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-05-08 | Warszawa / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-06-05 | Kraków / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-06-05 | Warszawa / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
  • konspekt szkolenia: Data Integration with Cloud Data Fusion

    Data Integration with Cloud Data Fusion szkolenie Google Cloud

    cena od: ---
    czas: 2 dni
    poziom trudności: 3 z 6
    kod: G-DICDF
    wersja: 1.0
  • konspekt szkolenia: Google Cloud Fundamentals for Researchers

    Google Cloud Fundamentals for Researchers szkolenie Google Cloud

    cena od: ---
    czas: 1 dzień
    poziom trudności: 2 z 6
    kod: G-GCFR
    wersja: 1.0
  • konspekt szkolenia: Managing a Data Mesh with Dataplex

    Managing a Data Mesh with Dataplex szkolenie Google Cloud

    cena od: ---
    czas: 2 dni
    poziom trudności: 3 z 6
    kod: G-MDMD
    wersja: 1.0
  • konspekt szkolenia: Data Engineering on Google Cloud

    Data Engineering on Google Cloud szkolenie Google Cloud

    dostępne terminy szkolenia
    cena od: 7000 PLN
    czas: 4 dni
    poziom trudności: 3 z 6
    kod: G-DEGC
    wersja: 3.0
    2026-01-20 | Kraków / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-01-20 | Warszawa / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-02-10 | Kraków / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-02-10 | Warszawa / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-03-10 | Kraków / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-03-10 | Warszawa / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-04-14 | Kraków / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-04-14 | Warszawa / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-05-12 | Kraków / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-05-12 | Warszawa / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-06-16 | Kraków / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-06-16 | Warszawa / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
  • konspekt szkolenia: Data Warehousing with BigQuery: Storage Design, Query Optimization, and Administration

    Data Warehousing with BigQuery: Storage Design, Query Optimization, and Administration szkolenie Google Cloud

    dostępne terminy szkolenia
    cena od: 5200 PLN
    czas: 3 dni
    poziom trudności: 3 z 6
    kod: G-DWBQ
    wersja: v1.0
    2026-02-02 | Kraków / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-02-02 | Warszawa / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-03-02 | Kraków / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-03-02 | Warszawa / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-04-13 | Kraków / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-04-13 | Warszawa / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-05-04 | Kraków / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-05-04 | Warszawa / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-06-08 | Kraków / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
    2026-06-08 | Warszawa / Wirtualna sala HYBRID: szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika zarezerwuj
  • konspekt szkolenia: Build Data Lakes and Data Warehouses on Google Cloud

    Build Data Lakes and Data Warehouses on Google Cloud szkolenie Google Cloud

    cena od: ---
    czas: 1 dzień
    poziom trudności: 2 z 6
    kod: G-BDLDWGC
    wersja: 3.0
  • konspekt szkolenia: Migrating Teradata Users to BigQuery

    Migrating Teradata Users to BigQuery szkolenie Google Cloud

    cena od: 2500 PLN
    czas: 1 dzień
    poziom trudności: 3 z 6
    kod: G-MTUBQ
    wersja: v1.0
  • konspekt szkolenia: Orchestrate BigQuery Workloads with Dataform

    Orchestrate BigQuery Workloads with Dataform szkolenie Google Cloud

    cena od: 2500 PLN
    czas: 1 dzień
    poziom trudności: 3 z 6
    kod: GC-OBQWD
    wersja: v1.0
  • konspekt szkolenia: Enterprise Database Migration

    Enterprise Database Migration szkolenie Google Cloud

    cena od: ---
    czas: 4 dni
    poziom trudności: 3 z 6
    kod: G-EDM
  • konspekt szkolenia: Build Streaming Data Pipelines on Google Cloud

    Build Streaming Data Pipelines on Google Cloud szkolenie Google Cloud

    cena od: ---
    czas: 1 dzień
    poziom trudności: 2 z 6
    kod: G-BSDPGC
    wersja: 3.0
Formularz kontaktowy

Prosimy o wypełnienie poniższego formularza, jeśli chcą Państwo uzyskać więcej informacji o powyższym szkoleniu.






* pola oznaczone (*) są wymagane

Informacje o przetwarzaniu danych przez Compendium – Centrum Edukacyjne Spółka z o.o.

CENA SZKOLENIA

Najbliższe szkolenia Google Cloud

  • 2026-01-14 | 2 dni | Kraków / Wirtualna sala

    Architecting with Google Kubernetes Engine

    szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika: HYBRID
  • 2026-01-14 | 2 dni | Warszawa / Wirtualna sala

    Architecting with Google Kubernetes Engine

    szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika: HYBRID
  • 2026-01-15 | 2 dni | Kraków / Wirtualna sala

    Logging, Monitoring and Observability in Google Cloud

    szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika: HYBRID
  • 2026-01-15 | 2 dni | Warszawa / Wirtualna sala

    Logging, Monitoring and Observability in Google Cloud

    szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika: HYBRID
  • 2026-01-19 | 3 dni | Kraków / Wirtualna sala

    Developing Applications with Google Cloud

    szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika: HYBRID
  • 2026-01-19 | 5 dni | Kraków / Wirtualna sala

    Google Cloud Architect Bootcamp

    szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika: HYBRID
  • 2026-01-19 | 1 dzień | Kraków / Wirtualna sala

    Google Cloud Fundamentals: Core Infrastructure

    szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika: HYBRID
  • 2026-01-19 | 3 dni | Kraków / Wirtualna sala

    Security in Google Cloud

    szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika: HYBRID
  • 2026-01-19 | 3 dni | Warszawa / Wirtualna sala

    Developing Applications with Google Cloud

    szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika: HYBRID
  • 2026-01-19 | 5 dni | Warszawa / Wirtualna sala

    Google Cloud Architect Bootcamp

    szkolenie dostępne w wersji stacjonarnej we wskazanej lokalizacji lub w trybie zdalnym, w zależności od preferencji uczestnika: HYBRID
Harmonogram szkoleń
Google Cloud