मुख्य सामग्री पर जाएँ

कोर्स

Databricks में Spark SQL के साथ Data Transformation

मध्यवर्ती3 घंटे

एंड-टू-एंड डेटा पाइपलाइन बनाएं - सफाई और एग्रीगेशन से लेकर स्ट्रीमिंग और ऑर्केस्ट्रेशन तक।

Python3 घंटे7 वीडियो25 अभ्यास1,750 XP1,536उपलब्धि का प्रमाणपत्र

अपना निःशुल्क खाता बनाएँ

Google के साथ जारी रखें
या
जारी रखकर, आप हमारी उपयोग की शर्तें, हमारी गोपनीयता नीति को स्वीकार करते हैं और यह भी कि आपका डेटा USA में संग्रहीत है।

हज़ारों कंपनियों के शिक्षार्थियों द्वारा पसंद किया गया

किसी टीम को प्रशिक्षित कर रहे हैं?

व्यवसायों के लिए आज़माएँ

कोर्स विवरण

क्या आप बड़े पैमाने पर वास्तविक दुनिया के डेटा को संभालने के लिए तैयार हैं? इस कोर्स में आप Databricks में Spark SQL और PySpark का उपयोग करके बड़े डेटासेट्स को ट्रांसफॉर्म करना सीखेंगे. आप डेटा को शेप और क्लीन करेंगे, optimized joins के साथ aggregations चलाएँगे, और advanced analytics के लिए window functions लागू करेंगे. आप fault-tolerant checkpoints के साथ file-based streaming सेट अप करेंगे और परिणामों को Delta tables के रूप में persist करेंगे. अंत तक, आप Databricks Workflows और Lakeflow Declarative Pipelines के साथ multi-step production pipelines को orchestration करेंगे.

पूर्वापेक्षाएँ

पाठ्यक्रम

कोर्स रूपरेखा

1

डेटा लोड करना और शेप देना

Databricks में Spark SQL के साथ Data Transformation

कोर्स
पूर्ण

उपलब्धि का प्रमाण पत्र अर्जित करें

अभी नामांकन करें

DataCamp for Mobile के साथ अपने डेटा कौशल बढ़ाएँ

हमारे मोबाइल कोर्स और रोज़ाना 5-मिनट की कोडिंग चुनौतियों के साथ चलते-फिरते प्रगति करें।