मुख्य सामग्री पर जाएँ

कोर्स

R में Intermediate Regular Expressions

मध्यवर्ती4 घंटे

R में regular expressions और string distances में महारत हासिल करके text data को manipulate करें, उसका विश्लेषण करें और भी बहुत कुछ करें।

R4 घंटे14 वीडियो48 अभ्यास3,650 XP4,781उपलब्धि का प्रमाणपत्र

अपना निःशुल्क खाता बनाएँ

Google के साथ जारी रखें
या
जारी रखकर, आप हमारी उपयोग की शर्तें, हमारी गोपनीयता नीति को स्वीकार करते हैं और यह भी कि आपका डेटा USA में संग्रहीत है।

हज़ारों कंपनियों के शिक्षार्थियों द्वारा पसंद किया गया

किसी टीम को प्रशिक्षित कर रहे हैं?

व्यवसायों के लिए आज़माएँ

कोर्स विवरण

टेबल के रूप में आने वाले डेटा का विश्लेषण करना मज़ेदार है। लेकिन अगर सबसे दिलचस्प बातें किसी सलीके से तैयार किए गए डेटासेट में नहीं, बल्कि सादा टेक्स्ट में हों तो? घबराइए नहीं: इस कोर्स में, आप ऐसे शक्तिशाली रेगुलर एक्सप्रेशन्स बनाना सीखेंगे जो सिर्फ टेक्स्ट के ब्लॉब से भी आपकी विश्लेषण के लिए ज़रूरी सारी जानकारी ढूँढने में मदद करें। और सिर्फ इतना ही नहीं। स्ट्रिंग डिस्टेंसेज़ की अवधारणा का उपयोग करके, आप ऐसे टेक्स्ट के साथ भी काम करना सीखेंगे जिसमें टाइपो या स्कैनिंग एरर हों, क्योंकि आप उन्हें अन्य डेटा सोर्सेज़ से उनके सही समकक्षों से मिलान कर सकेंगे (रिकॉर्ड लिंकेंज)। सीखने की सामग्री के तौर पर, हम स्विस सिनेमाघरों के बॉक्स ऑफिस फ़िगर्स से जुड़े असली डॉक्यूमेंट्स का विश्लेषण करेंगे।

पूर्वापेक्षाएँ

पाठ्यक्रम

कोर्स रूपरेखा

1

Regular Expressions: कस्टम पैटर्न लिखना

रेगुलर एक्सप्रेशन्स शुरुआत में काफ़ी डरावने लग सकते हैं क्योंकि इनमें बहुत सारे स्पेशल कैरेक्टर होते हैं। इस चैप्टर में, आप इन्हें समझना और अपने खुद के पैटर्न लिखना सीखेंगे ताकि ठीक वही मिल सके जिसकी आप तलाश कर रहे हैं।
अध्याय शुरू करें
3

टेक्स्ट से संरचित डेटा निकालना

वह काम जहाँ रेगुलर एक्सप्रेशन्स सच में चमकते हैं, वह है सादे टेक्स्ट से मतलब निकालना। इस चैप्टर में, आप ऐसे गंदे डेटा से जानकारी निकालना सीखेंगे जो सलीके से व्यवस्थित टेबल्स में नहीं, बल्कि प्लेन टेक्स्ट में होता है।
अध्याय शुरू करें
4

स्ट्रिंग्स के बीच समानताएँ

आख़िरी चैप्टर में, हम रेगुलर एक्सप्रेशन्स से हटकर स्ट्रिंग डिस्टेंसेज़ को समझेंगे। कई स्ट्रिंग्स के बीच अंतर मापकर, हम उन स्ट्रिंग्स का मिलान कर सकते हैं जो आपस में मिलती-जुलती हों। इससे हमें डुप्लिकेट्स ढूँढने में मदद मिलेगी, भले ही उनमें छोटे-छोटे एरर, जैसे टाइपो, मौजूद हों। यह रिकॉर्ड लिंकेंज का अहम हिस्सा है जहाँ हम कई सोर्सेज़ से आए डेटासेट्स को जोड़ते हैं।
अध्याय शुरू करें
R

R में Intermediate Regular Expressions

कोर्स
पूर्ण

उपलब्धि का प्रमाण पत्र अर्जित करें

अभी नामांकन करें

DataCamp for Mobile के साथ अपने डेटा कौशल बढ़ाएँ

हमारे मोबाइल कोर्स और रोज़ाना 5-मिनट की कोडिंग चुनौतियों के साथ चलते-फिरते प्रगति करें।