मुख्य सामग्री पर जाएं

कोर्स

R में Intermediate Regular Expressions

इंटरमीडिएट4 घंटे

R में regular expressions और string distances में महारत हासिल करके text data को manipulate करें, उसका विश्लेषण करें और भी बहुत कुछ करें।

R4 घंटे14 वीडियो48 अभ्यास3,650 XP4,760उपलब्धि प्रमाणपत्र

अपना नि:शुल्क अकाउंट बनाएँ

Google के साथ जारी रखें
या
जारी रखकर, आप हमारी उपयोग की शर्तें, हमारा गोपनीयता नीति और यह कि आपका डेटा USA में संग्रहीत है।

हज़ारों कंपनियों के शिक्षार्थियों द्वारा पसंद किया गया

टीम को प्रशिक्षित कर रहे हैं?

बिज़नेस आज़माएँ

कोर्स विवरण

टेबल के रूप में आने वाले डेटा का विश्लेषण करना मज़ेदार है। लेकिन अगर सबसे दिलचस्प बातें किसी सलीके से तैयार किए गए डेटासेट में नहीं, बल्कि सादा टेक्स्ट में हों तो? घबराइए नहीं: इस कोर्स में, आप ऐसे शक्तिशाली रेगुलर एक्सप्रेशन्स बनाना सीखेंगे जो सिर्फ टेक्स्ट के ब्लॉब से भी आपकी विश्लेषण के लिए ज़रूरी सारी जानकारी ढूँढने में मदद करें। और सिर्फ इतना ही नहीं। स्ट्रिंग डिस्टेंसेज़ की अवधारणा का उपयोग करके, आप ऐसे टेक्स्ट के साथ भी काम करना सीखेंगे जिसमें टाइपो या स्कैनिंग एरर हों, क्योंकि आप उन्हें अन्य डेटा सोर्सेज़ से उनके सही समकक्षों से मिलान कर सकेंगे (रिकॉर्ड लिंकेंज)। सीखने की सामग्री के तौर पर, हम स्विस सिनेमाघरों के बॉक्स ऑफिस फ़िगर्स से जुड़े असली डॉक्यूमेंट्स का विश्लेषण करेंगे।

पूर्वापेक्षाएँ

पाठ्यक्रम

कोर्स रूपरेखा

1

Regular Expressions: कस्टम पैटर्न लिखना

रेगुलर एक्सप्रेशन्स शुरुआत में काफ़ी डरावने लग सकते हैं क्योंकि इनमें बहुत सारे स्पेशल कैरेक्टर होते हैं। इस चैप्टर में, आप इन्हें समझना और अपने खुद के पैटर्न लिखना सीखेंगे ताकि ठीक वही मिल सके जिसकी आप तलाश कर रहे हैं।
अध्याय शुरू करें
3

टेक्स्ट से संरचित डेटा निकालना

वह काम जहाँ रेगुलर एक्सप्रेशन्स सच में चमकते हैं, वह है सादे टेक्स्ट से मतलब निकालना। इस चैप्टर में, आप ऐसे गंदे डेटा से जानकारी निकालना सीखेंगे जो सलीके से व्यवस्थित टेबल्स में नहीं, बल्कि प्लेन टेक्स्ट में होता है।
अध्याय शुरू करें
4

स्ट्रिंग्स के बीच समानताएँ

आख़िरी चैप्टर में, हम रेगुलर एक्सप्रेशन्स से हटकर स्ट्रिंग डिस्टेंसेज़ को समझेंगे। कई स्ट्रिंग्स के बीच अंतर मापकर, हम उन स्ट्रिंग्स का मिलान कर सकते हैं जो आपस में मिलती-जुलती हों। इससे हमें डुप्लिकेट्स ढूँढने में मदद मिलेगी, भले ही उनमें छोटे-छोटे एरर, जैसे टाइपो, मौजूद हों। यह रिकॉर्ड लिंकेंज का अहम हिस्सा है जहाँ हम कई सोर्सेज़ से आए डेटासेट्स को जोड़ते हैं।
अध्याय शुरू करें
R

R में Intermediate Regular Expressions

कोर्स
पूरा

उपलब्धि प्रमाणपत्र प्राप्त करें

अभी नामांकन करें

DataCamp for Mobile के साथ अपने डेटा कौशल बढ़ाएं

हमारे मोबाइल पाठ्यक्रमों और दैनिक 5-मिनट कोडिंग चुनौतियों के साथ चलते-फिरते प्रगति करें।