ข้ามไปยังเนื้อหาหลัก

คอร์ส

การแปลงข้อมูลด้วย Spark SQL ใน Databricks

ขั้นกลาง3 ชม.

สร้าง data pipelines แบบ end-to-end — ตั้งแต่การทำความสะอาดและการรวมข้อมูล ไปจนถึง streaming และ orchestration

Python3 ชม.7 วิดีโอ25 แบบฝึกหัด1,750 XP1,530หนังสือรับรองความสำเร็จ

สร้างบัญชีฟรีของคุณ

ดำเนินการต่อด้วย Google
หรือ
เมื่อดำเนินการต่อ ถือว่าคุณยอมรับ ข้อกำหนดการใช้งานและ นโยบายความเป็นส่วนตัว และยอมรับว่าข้อมูลของคุณจะถูกจัดเก็บในสหรัฐอเมริกา

ได้รับความไว้วางใจจากผู้เรียนในบริษัทหลายพันแห่ง

กำลังฝึกอบรมทีมอยู่ใช่ไหม?

ทดลองใช้สำหรับองค์กร

รายละเอียดคอร์ส

พร้อมรับมือกับข้อมูลขนาดใหญ่ในโลกจริงแล้วหรือยัง? คอร์สนี้จะสอนวิธีแปลงชุดข้อมูลขนาดใหญ่โดยใช้ Spark SQL และ PySpark ใน Databricks ตั้งแต่การจัดรูปแบบและทำความสะอาดข้อมูล การรวมข้อมูลด้วย join ที่ปรับแต่งประสิทธิภาพแล้ว ไปจนถึงการใช้ window function สำหรับการวิเคราะห์ขั้นสูง นอกจากนี้ยังครอบคลุมการตั้งค่า streaming แบบไฟล์พร้อม checkpoint ที่รองรับความเสียหาย และการบันทึกผลลัพธ์เป็น Delta table เมื่อจบคอร์ส จะสามารถจัดการ pipeline การผลิตแบบหลายขั้นตอนด้วย Databricks Workflows และ Lakeflow Declarative Pipelines ได้

ข้อกำหนดเบื้องต้น

หลักสูตร

โครงร่างคอร์ส

1

การโหลดและจัดรูปแบบข้อมูล

การแปลงข้อมูลด้วย Spark SQL ใน Databricks

เรียนคอร์สจบแล้ว

รับใบรับรองความสำเร็จ

ลงทะเบียนเลย

พัฒนาทักษะด้านข้อมูลของคุณด้วย DataCamp for Mobile

เรียนรู้ได้ทุกที่ด้วยคอร์สบนมือถือและโจทย์เขียนโค้ด 5 นาทีประจำวัน