CloudTeam

Menu główne

Kontakt

SzkoleniaDane i analityka / Data & AIDP-750

DP-750Microsoft · szkolenie autoryzowaneProwadzi do egzaminu

Implement data engineering solutions using Azure Databricks

Kurs pokazuje, jak budować i utrzymywać rozwiązania inżynierii danych w Azure Databricks z wykorzystaniem Unity Catalog, od konfiguracji środowiska po wdrożenie produkcyjne. Uczestnicy poznają sposoby zabezpieczania i governance danych, budowania pipeline'ów pozyskiwania i przetwarzania danych oraz monitorowania i optymalizacji obciążeń. Kurs obejmuje pełny cykl życia rozwiązania lakehouse w środowisku Azure.

Czas trwania
4 dni
Poziom
Średni
Dostawca
Microsoft
Obszar
Dane i analityka / Data & AI

Zakres szkolenia

  • Ścieżka: Konfiguracja środowiska Azure Databricks
  • Eksploracja Azure Databricks
  • Architektura Azure Databricks
  • Integracje Azure Databricks
  • Wybór i konfiguracja compute w Azure Databricks
  • Tworzenie i organizacja obiektów w Unity Catalog
  • Ścieżka: Zabezpieczanie i governance obiektów Unity Catalog
  • Zabezpieczanie obiektów Unity Catalog
  • Governance obiektów Unity Catalog
  • Ścieżka: Przygotowanie i przetwarzanie danych z Azure Databricks
  • Modelowanie danych w Azure Databricks
  • Pozyskiwanie danych do Unity Catalog
  • Czyszczenie, transformacja i ładowanie danych do Unity Catalog
  • Implementacja i zarządzanie ograniczeniami jakości danych
  • Ścieżka: Wdrażanie i utrzymanie pipeline'ów danych i obciążeń
  • Projektowanie i implementacja pipeline'ów danych
  • Implementacja Lakeflow Jobs
  • Procesy cyklu życia rozwoju w Azure Databricks
  • Monitorowanie, diagnozowanie i optymalizacja obciążeń

Zdobyte umiejętności

  • Konfigurowanie środowiska Azure Databricks i zasobów obliczeniowych
  • Tworzenie i organizowanie obiektów w Unity Catalog
  • Zabezpieczanie i governance obiektów Unity Catalog
  • Projektowanie modeli danych i wzorców pozyskiwania danych
  • Pozyskiwanie, czyszczenie i transformacja danych w Unity Catalog
  • Wdrażanie kontroli jakości danych
  • Projektowanie i implementacja pipeline'ów danych w architekturze lakehouse
  • Monitorowanie, diagnozowanie i optymalizacja obciążeń w Azure Databricks

Dla kogo jest to szkolenie

  • Docelową grupą są inżynierowie danych posiadający podstawową wiedzę z zakresu koncepcji analizy danych, podstawową znajomość przechowywania danych w chmurze oraz zasad organizacji danych
  • Osoby te powinny swobodnie posługiwać się SQL oraz mieć doświadczenie w pracy z Pythonem, w tym notebookami, w zadaniach inżynierii danych
  • Uczestnicy powinni dobrze rozumieć obszary robocze Azure Databricks i Unity Catalog, wzorce dostępu do danych oraz podstawowe koncepcje inżynierii danych i hurtowni danych
  • Wymagana jest również podstawowa znajomość zabezpieczeń Azure, w tym Microsoft Entra ID, oraz podstaw kontroli wersji Git

Wymagania wstępne

  • Podstawowa wiedza z zakresu koncepcji analizy danych i przechowywania danych w chmurze
  • Znajomość zasad organizacji danych
  • Umiejętność pracy z SQL
  • Doświadczenie w pracy z Pythonem, w tym notebookami, w zadaniach inżynierii danych
  • Znajomość obszarów roboczych Azure Databricks i Unity Catalog
  • Znajomość wzorców dostępu do danych oraz podstawowych koncepcji inżynierii danych i hurtowni danych
  • Podstawowa znajomość zabezpieczeń Azure, w tym Microsoft Entra ID
  • Podstawy kontroli wersji Git

Certyfikacja

Egzamin

DP-750 - Microsoft Certified: Azure Databricks Data Engineer Associate

Szkolenie przygotowuje do tego egzaminu.

Szczegóły egzaminu