メインコンテンツにスキップ

コース

Databricks における Spark SQL を使ったデータ変換

中級3 時間

データパイプラインを一気通貫で構築 - クレンジング、集計からストリーミング、オーケストレーションまで。

Python3 時間動画 7 本演習 25 件1,750 XP1,536修了証明書

無料アカウントを作成する

Googleで続行
または
続行すると、次に同意したものとみなされます: 利用規約プライバシーポリシー 、およびデータが米国内に保管されることに同意したものとみなされます。

何千もの企業の学習者に愛されています

チームでトレーニングをお考えですか?

法人向けプランを試す

コースの説明

大規模なデータを実務で扱う準備はできていますか?このコースでは、Databricks 上で Spark SQL と PySpark を使って大規模データセットを変換する方法を学びます。データの整形とクリーニング、最適化されたジョインを用いた集計、高度な分析のためのウィンドウ関数の適用などを習得します。また、フォールトトレラントなチェックポイントを備えたファイルベースのストリーミングの設定や、Delta テーブルへの結果の永続化も取り上げます。コースの終わりには、Databricks Workflows と Lakeflow Declarative Pipelines を使って、複数ステップの本番パイプラインを構築・管理できるようになります。

前提条件

カリキュラム

コース概要

Databricks における Spark SQL を使ったデータ変換

コース修了

修了証明書を取得

今すぐ登録する

DataCamp for Mobileでデータスキルを伸ばしましょう

モバイルコースと毎日5分のコーディングチャレンジで、外出先でも学習を進められます。