Szkolenia Microsoft

Cel szkolenia

kod: DP-3011 | wersja: A

Ten kurs bada, jak używać środowiska Databricks i Apache Spark na platformie Azure, aby przeprowadzić projekty danych od etapu eksploracji do produkcji. Dowiesz się, jak pozyskiwać, przekształcać i analizować zestawy danych o dużej skali za pomocą Spark DataFrames, Spark SQL i PySpark, jednocześnie budując pewność siebie w zarządzaniu rozproszonym przetwarzaniem danych. Zagłębisz się również w praktyki inżynierii danych, w tym projektowanie potoków ETL, obsługę ewolucji schematów i egzekwowanie jakości danych. Następnie kurs przechodzi do orkiestracji, pokazując, jak automatyzować i zarządzać obciążeniami za pomocą Lakeflow Jobs i potoków. Na koniec poznasz możliwości zarządzania i bezpieczeństwa, takie jak Unity Catalog i integracja z usługą Purview.

 

Profil odbiorców:
Przed rozpoczęciem tego kursu uczestnicy powinni już swobodnie posługiwać się podstawami języków Python i SQL. Ważna jest znajomość witryny Azure portal i podstawowych usług, takich jak Azure Storage, wraz z ogólną świadomością koncepcji danych, takich jak przetwarzanie wsadowe w porównaniu do przetwarzania strumieniowego oraz dane ustrukturyzowane w porównaniu do nieustrukturyzowanych.

 

Plan szkolenia Rozwiń listę

  • Wdrażanie rozwiązań analizy danych przy użyciu usługi Azure Databricks
    • Moduł 1: Eksploracja usługi Azure Databricks
    • Moduł 2: Przeprowadzanie analizy danych w usłudze Azure Databricks
    • Moduł 3: Używanie platformy Apache Spark w usłudze Azure Databricks
    • Moduł 4: Zarządzanie danymi przy użyciu usługi Delta Lake
    • Moduł 5: Tworzenie deklaratywnych potoków Lakeflow
    • Moduł 6: Wdrażanie obciążeń za pomocą Lakeflow Jobs
Pobierz konspekt szkolenia w formacie PDF

Dodatkowe informacje

Wymagania wstępne

Biegłość w podstawach języków Python i SQL. Umiejętność pisania prostych skryptów w języku Python, pracy z popularnymi strukturami danych oraz pisania zapytań SQL w celu filtrowania, łączenia i agregowania danych. Podstawowe zrozumienie popularnych formatów plików (CSV, JSON, Parquet). Znajomość witryny Azure portal i podstawowych usług, takich jak Azure Storage. Świadomość koncepcji danych (przetwarzanie wsadowe vs strumieniowe, dane ustrukturyzowane vs nieustrukturyzowane).

Poziom trudności
Czas trwania 1 dzień
Certyfikat

Uczestnicy otrzymają certyfikaty podpisane przez Microsoft (ukończenie kursu).

Prowadzący

Microsoft Certified Trainer (MCT)

Pozostałe szkolenia Microsoft | Data & AI

Formularz kontaktowy

Prosimy o wypełnienie poniższego formularza, jeśli chcą Państwo uzyskać więcej informacji o powyższym szkoleniu.






* pola oznaczone (*) są wymagane

Informacje o przetwarzaniu danych przez Compendium – Centrum Edukacyjne Spółka z o.o.

CENA SZKOLENIA OD 1400 PLN NETTO

Najbliższe szkolenia Microsoft

Harmonogram szkoleń Microsoft