कॉम्बो-अटैक!
आपने डेटा मैनिप्युलेशन की चार सबसे आम किस्में देखी हैं: रो को sort करना, कॉलम subset करना, रो subset करना, और नए कॉलम जोड़ना। असली दुनिया के डेटा विश्लेषण में, आप इन चारों को मिलाकर कई तरह के सवालों के जवाब दे सकते हैं।
इस अभ्यास में, आप यह सवाल हल करेंगे: "किस state में प्रति 10,000 लोगों पर बेघर व्यक्तियों की संख्या सबसे अधिक है?" यह जानने के लिए अपनी नई pandas स्किल्स को मिलाकर उपयोग करें।
यह अभ्यास पाठ्यक्रम का हिस्सा है
pandas के साथ Data Manipulation
अभ्यास निर्देश
homelessnessमें एक नया कॉलमindiv_per_10kजोड़ें, जिसमें हर state के प्रति दस हज़ार लोगों पर बेघर व्यक्तियों की संख्या हो. इसके लिए state की आबादी के रूप मेंstate_popका उपयोग करें.- जिन रो में
indiv_per_10k20से अधिक है, उन्हें subset करकेhigh_homelessnessमें असाइन करें. high_homelessnessकोindiv_per_10kके descending क्रम में sort करें औरhigh_homelessness_srtमें असाइन करें.high_homelessness_srtसे सिर्फstateऔरindiv_per_10kकॉलम चुनें औरresultके रूप में सेव करें.resultको देखिए.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Create indiv_per_10k col as homeless individuals per 10k state pop
homelessness["indiv_per_10k"] = 10000 * ____ / ____
# Subset rows for indiv_per_10k greater than 20
high_homelessness = ____
# Sort high_homelessness by descending indiv_per_10k
high_homelessness_srt = ____
# From high_homelessness_srt, select the state and indiv_per_10k cols
result = ____
# See the result
print(result)