or
यह अभ्यास पाठ्यक्रम का हिस्सा है
इस अध्याय में, हम उन कारणों पर चर्चा करेंगे जिनकी वजह से आपको नई तकनीकें अपनानी पड़ती हैं जब डेटा सेट उपलब्ध RAM से बड़े हों। हम दिखाएँगे कि base R फंक्शंस से डेटा इम्पोर्ट और एक्सपोर्ट करना धीमा हो सकता है और इसे ठीक करने के कुछ आसान तरीके क्या हैं। अंत में, हम bigmemory पैकेज का परिचय देंगे।
अब जबकि आपने bigmemory का कुछ अनुभव ले लिया है, हम कुछ सरल डेटा एक्सप्लोरेशन और विश्लेषण तकनीकों से गुजरेंगे। खासतौर पर, हम देखेंगे कि टेबल कैसे बनानी हैं और split-apply-combine अप्रोच कैसे लागू करनी है।
हम iotools पैकेज का उपयोग करेंगे जो numeric और string दोनों तरह के डेटा को प्रोसेस कर सकता है, और chunk-wise प्रोसेसिंग की अवधारणा का परिचय देंगे。
पिछले अध्यायों में, हमने हाउसिंग डेटा का परिचय दिया और दिखाया कि एक सिंगल मशीन की RAM जितना या उससे बड़ा डेटा कैसे प्रोसेस करें। इस अध्याय में, हम डेटा का एक प्रारंभिक विश्लेषण करेंगे और समय के साथ विभिन्न ट्रेंड्स की तुलना करेंगे।
वर्तमान अभ्यास