After doing these courses, I feel confident creating professional visualizations and dashboards
Opis kursu
Opanuj narzędzia i techniki tworzenia niezawodnych, zautomatyzowanych potoków danych w Snowflake. Zaczniesz od nauki, jak pozyskiwać dane na dużą skalę — konfigurując stage’e i formaty plików, ładując dane za pomocą COPY INTO oraz wybierając między ładowaniem wsadowym, Snowpipe i Snowpipe Streaming w zależności od wymagań dotyczących opóźnień i wolumenu.
Stamtąd rozwiniesz umiejętności orkiestracji kompleksowych pipeline’ów end-to-end: przechwytywania zmian na poziomie wierszy za pomocą strumieni, łączenia wieloetapowych workflow za pomocą DAG-ów zadań oraz tworzenia deklaratywnych, automatycznie odświeżanych pipeline’ów z dynamicznymi tabelami. Nauczysz się też, kiedy sięgać po zewnętrzne tabele i tabele Iceberg w scenariuszach wielosilnikowych oraz natywnie chmurowych.
Druga połowa kursu doskonali Twoje umiejętności zapytań i transformacji — wyodrębnianie i rozpakowywanie półstrukturalnego JSON z kolumn VARIANT, stosowanie rozszerzeń grupowania i funkcji okienkowych do zaawansowanej analityki oraz zamykanie wielokrotnego użytku logiki w UDF-ach i procedurach składowanych.
Na koniec zajmiesz się wydajnością zapytań: nauczysz się czytać Query Profile w Snowflake, aby wskazywać wąskie gardła, wybierać odpowiednie narzędzie optymalizacyjne — Search Optimization, Query Acceleration Service, clustering keys lub materialized views — oraz pisać SQL przyjazny dla cache, który unika typowych antywzorców cicho obniżających wydajność.
Wymagania wstępne
Ten kurs nie ma wymagań wstępnych
Program kursu
Plan kursu
1
Ładowanie, wczytywanie i łączność danych
Opanuj potok wczytywania danych w Snowflake — od umieszczania plików na staging przez COPY INTO, Snowpipe i Snowpipe Streaming — oraz połącz Snowflake z szerszym ekosystemem danych za pomocą konektorów, sterowników i narzędzi eksportu.
- Etapy, formaty plików i COPY INTO50 XP
- Klasyfikacja typów stage'y100 XP
- Obsługa błędów w COPY INTO50 XP
- Snowpipe i Snowpipe Streaming50 XP
- Wybór odpowiedniej metody ingestion50 XP
- Charakterystyka metod ingestion100 XP
- Eksport danych i łączność50 XP
- Eksportowanie danych do przechowalni w chmurze50 XP
- Mechanizmy łączności100 XP
2
Orkiestracja potoków i obiekty danych
Buduj solidne potoki danych z wykorzystaniem natywnej orkiestracji Snowflake — strumieni do przechwytywania zmian, zadań do harmonogramowania, tabel dynamicznych do deklaratywnych transformacji oraz tabel zewnętrznych i Iceberg do przechowywania danych w otwartych formatach.
3
Odpytywanie i przekształcanie danych
Odpytuj częściowo ustrukturyzowane dane JSON za pomocą notacji kropkowej i FLATTEN, agreguj dane z użyciem GROUPING SETS, ROLLUP i CUBE, obliczaj funkcje okna oraz zamykaj wielokrotnego użytku logikę w funkcjach UDF i procedurach składowanych.
4
Wydajność i optymalizacja zapytań
Profiluj zapytania w Snowsight, identyfikuj wąskie gardła za pomocą QUERY_HISTORY, stosuj optymalizację wyszukiwania, usługę Query Acceleration Service, automatyczne klastrowanie i zmaterializowane widoki, a także pisz SQL korzystający z trzech warstw pamięci podręcznej Snowflake.
S
Automatyzacja potoków danych w Snowflake
Kurs
ukończony

