ข้ามไปยังเนื้อหาหลัก

คอร์ส

การแปลงข้อมูลด้วย Spark SQL ใน Databricks

ระดับกลาง3 ชม.

สร้าง data pipelines แบบ end-to-end — ตั้งแต่การทำความสะอาดและการรวมข้อมูล ไปจนถึง streaming และ orchestration

Python3 ชม.7 วิดีโอ25 แบบฝึกหัด1,750 XP1,111ใบแสดงความสำเร็จ

สร้างบัญชีฟรีของคุณ

ดำเนินการต่อด้วย Google
หรือ
การดำเนินการต่อหมายความว่าคุณยอมรับ เงื่อนไขการใช้งาน, ของเรา นโยบายความเป็นส่วนตัว และข้อมูลของคุณถูกจัดเก็บไว้ในสหรัฐอเมริกา

ได้รับความไว้วางใจจากผู้เรียนในหลายพันบริษัท

รายละเอียดคอร์ส

พร้อมรับมือกับข้อมูลขนาดใหญ่ในโลกจริงแล้วหรือยัง? คอร์สนี้จะสอนวิธีแปลงชุดข้อมูลขนาดใหญ่โดยใช้ Spark SQL และ PySpark ใน Databricks ตั้งแต่การจัดรูปแบบและทำความสะอาดข้อมูล การรวมข้อมูลด้วย join ที่ปรับแต่งประสิทธิภาพแล้ว ไปจนถึงการใช้ window function สำหรับการวิเคราะห์ขั้นสูง นอกจากนี้ยังครอบคลุมการตั้งค่า streaming แบบไฟล์พร้อม checkpoint ที่รองรับความเสียหาย และการบันทึกผลลัพธ์เป็น Delta table เมื่อจบคอร์ส จะสามารถจัดการ pipeline การผลิตแบบหลายขั้นตอนด้วย Databricks Workflows และ Lakeflow Declarative Pipelines ได้

ข้อกำหนดเบื้องต้น

หลักสูตร

โครงสร้างคอร์ส

1

การโหลดและจัดรูปแบบข้อมูล

การแปลงข้อมูลด้วย Spark SQL ใน Databricks

เรียนจบแล้ว

รับใบรับรองความสำเร็จ

ลงทะเบียนเลย

พัฒนาทักษะด้านข้อมูลของคุณด้วย DataCamp บนมือถือ

ก้าวหน้าได้ทุกที่ด้วยคอร์สมือถือและแบบฝึกหัดการเขียนโค้ด 5 นาทีประจำวันของเรา