跳至内容
首页Databricks

课程

在 Databricks 中使用 Spark SQL 进行数据转换

中级技能水平
更新时间 2026年7月
构建端到端数据管道——从清洗和聚合到流处理和编排。
免费开始课程
DatabricksData Engineering
3小时
7 视频
25 道练习
1,750 XP
成就证明

创建您的免费帐户

继续使用 Google显示更多选项


继续操作即表示您接受我们的《使用条款》和《隐私政策》,并同意您的数据存储在美国。

深受数千家公司学习者的喜爱

Group

需要团队培训?

企业版试用

课程描述

准备好在大规模场景中处理真实世界的数据了吗?本课程将带您在 Databricks 中使用 Spark SQL 和 PySpark 转换海量数据集。您将学习整理与清洗数据、使用优化的连接执行聚合,并应用窗口函数完成高级分析。您还会搭建基于文件的流处理,配置具备容错能力的检查点,并将结果持久化为 Delta 表。课程结束时,您将能够使用 Databricks Workflows 和 Lakeflow Declarative Pipelines 编排多步骤的生产级管道。

先决条件

Introduction to Databricks SQLIntroduction to PySpark
1

加载与整形数据

本章将带您了解如何使用 Databricks 笔记本,将 CSV 数据加载到 Spark DataFrame 中,并用 PySpark 与 SQL 对数据进行整形。
开始章节
2

数据清洗与优化

学习如何定义显式架构,构建数据清洗管道,并通过广播连接优化查询性能。
开始章节
在 Databricks 中使用 Spark SQL 进行数据转换
课程完成

获得成就证明

将此证书添加到您的 LinkedIn 档案、简历或履历中
在社交媒体和绩效评估中分享
立即注册

加入超过19百万学习者,今天就开始在 Databricks 中使用 Spark SQL 进行数据转换!

创建您的免费帐户

继续使用 Google显示更多选项


继续操作即表示您接受我们的《使用条款》和《隐私政策》,并同意您的数据存储在美国。

通过 DataCamp for Mobile 提升您的数据技能

随时随地通过我们的移动课程和每日 5 分钟编程挑战提升技能。