or
यह अभ्यास पाठ्यक्रम का हिस्सा है
डेटाबेस की जाँच की शुरुआत तालिकाओं और उन्हें जोड़ने वाली foreign keys की पहचान से करें। missing values ढूँढ़ें, observations की संख्या गिनें, और तालिकाओं को जॉइन करके समझें कि वे आपस में कैसे संबंधित हैं। इस दौरान coalescing और casting के बारे में भी जानें।
आप min और max जैसे फंक्शनों पर आगे बढ़ते हुए न्यूमेरिक डेटा का नए तरीकों से सारांश बनाना सीखेंगे। अपनी टूलकिट में average, variance, correlation, और percentile फंक्शनों को जोड़ें, और numeric वैल्यूज़ को truncate और round करना भी सीखें। complex क्वेरी बनाएँ और temporary tables बनाकर अपने परिणाम सेव करें।
टेक्स्ट, या character, डेटा अक्सर बिखरा हुआ होता है, लेकिन आप case, spacing, और delimiters में inconsistencies से निपटना सीखेंगे। एक temporary table का उपयोग करके उलझे हुए categorical डेटा को मानकीकृत वैल्यूज़ में recode करना सीखें जिन्हें आप count और aggregate कर सकें। Evanston, IL को सबमिट की गई help requests को एक्सप्लोर करते समय unstructured टेक्स्ट से नए वैरिएबल निकालें।
समय क्या हुआ है? इस अध्याय में, आप जानना सीखेंगे। आप date/time डेटा को hour, day, month, या year के हिसाब से aggregate करेंगे और time series बनाना तथा उनमें gaps ढूँढ़ने का अभ्यास करेंगे।
वर्तमान अभ्यास