Build your ultimate AI agent
कोर्स विवरण
टेबल के रूप में आने वाले डेटा का विश्लेषण करना मज़ेदार है। लेकिन अगर सबसे दिलचस्प बातें किसी सलीके से तैयार किए गए डेटासेट में नहीं, बल्कि सादा टेक्स्ट में हों तो? घबराइए नहीं: इस कोर्स में, आप ऐसे शक्तिशाली रेगुलर एक्सप्रेशन्स बनाना सीखेंगे जो सिर्फ टेक्स्ट के ब्लॉब से भी आपकी विश्लेषण के लिए ज़रूरी सारी जानकारी ढूँढने में मदद करें। और सिर्फ इतना ही नहीं। स्ट्रिंग डिस्टेंसेज़ की अवधारणा का उपयोग करके, आप ऐसे टेक्स्ट के साथ भी काम करना सीखेंगे जिसमें टाइपो या स्कैनिंग एरर हों, क्योंकि आप उन्हें अन्य डेटा सोर्सेज़ से उनके सही समकक्षों से मिलान कर सकेंगे (रिकॉर्ड लिंकेंज)। सीखने की सामग्री के तौर पर, हम स्विस सिनेमाघरों के बॉक्स ऑफिस फ़िगर्स से जुड़े असली डॉक्यूमेंट्स का विश्लेषण करेंगे।
पूर्वापेक्षाएँ
पाठ्यक्रम
कोर्स रूपरेखा
1
Regular Expressions: कस्टम पैटर्न लिखना
रेगुलर एक्सप्रेशन्स शुरुआत में काफ़ी डरावने लग सकते हैं क्योंकि इनमें बहुत सारे स्पेशल कैरेक्टर होते हैं। इस चैप्टर में, आप इन्हें समझना और अपने खुद के पैटर्न लिखना सीखेंगे ताकि ठीक वही मिल सके जिसकी आप तलाश कर रहे हैं।
- स्वागत50 XP
- शुरू होता है, खत्म होता है100 XP
- जब आपको ठीक-ठीक न पता हो कि क्या ढूँढना है100 XP
- करेक्टर क्लासेस और रिपिटिशन50 XP
- Digits, words and spaces100 XP
- Repetitions मैच करें100 XP
- कौन-सा स्पेशल कैरेक्टर क्या करता है, याद है?100 XP
- Pipe और प्रश्नवाचक चिन्ह50 XP
- यह या वह100 XP
- प्रश्नवाचक चिन्ह और उसके दो अर्थ100 XP
- अब आप इसे पढ़ सकते हैं!50 XP
2
डेटा से स्ट्रिंग बनाना
इस चैप्टर में, हम थोड़ी देर के लिए रेगुलर एक्सप्रेशन्स से हटकर स्ट्रिंग मैनिपुलेशन पर ध्यान देंगे — जैसे वेक्टर या लिस्ट जैसी अन्य डेटा स्ट्रक्चर्स से स्ट्रिंग बनाना।
3
टेक्स्ट से संरचित डेटा निकालना
वह काम जहाँ रेगुलर एक्सप्रेशन्स सच में चमकते हैं, वह है सादे टेक्स्ट से मतलब निकालना। इस चैप्टर में, आप ऐसे गंदे डेटा से जानकारी निकालना सीखेंगे जो सलीके से व्यवस्थित टेबल्स में नहीं, बल्कि प्लेन टेक्स्ट में होता है।
4
स्ट्रिंग्स के बीच समानताएँ
आख़िरी चैप्टर में, हम रेगुलर एक्सप्रेशन्स से हटकर स्ट्रिंग डिस्टेंसेज़ को समझेंगे। कई स्ट्रिंग्स के बीच अंतर मापकर, हम उन स्ट्रिंग्स का मिलान कर सकते हैं जो आपस में मिलती-जुलती हों। इससे हमें डुप्लिकेट्स ढूँढने में मदद मिलेगी, भले ही उनमें छोटे-छोटे एरर, जैसे टाइपो, मौजूद हों। यह रिकॉर्ड लिंकेंज का अहम हिस्सा है जहाँ हम कई सोर्सेज़ से आए डेटासेट्स को जोड़ते हैं।
R
R में Intermediate Regular Expressions
कोर्स
पूरा

