Correlation और R-squared
दो वैरिएबल \(x\) और \(y\) का रैखिक सहसंबंध, उनके बीच रैखिक संबंध की मज़बूती को मापता है। जब \(x\) और \(y\) क्रमशः ये हों:
- किसी ऐसे रिग्रेशन मॉडल के आउटपुट जो squared-error को न्यूनतम करता है (जैसे linear regression), और
- प्रशिक्षण डेटा के true outcomes,
तो सहसंबंध का वर्ग \(R^2\) के बराबर होता है। आप इसे इस अभ्यास में जाँचेंगे।
unemployment और unemployment_model आपके उपयोग के लिए उपलब्ध हैं.
यह अभ्यास पाठ्यक्रम का हिस्सा है
R में Supervised Learning: Regression
अभ्यास निर्देश
cor()(docs) का उपयोग करके प्रेडिक्शंस और महिला बेरोज़गारी के बीच सहसंबंध निकालिए। इसे वैरिएबलrhoमें असाइन करके प्रिंट कीजिए। सुनिश्चित करें कि आप Pearson correlation (डिफ़ॉल्ट) ही उपयोग कर रहे हैं।rhoका वर्ग लीजिए और इसेrho2में असाइन कीजिए। फिर प्रिंट कीजिए।- मॉडल से प्राप्त \(R^2\) (
glance()का उपयोग करके) सेrho2की तुलना कीजिए। क्या यह समान है?
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# unemployment is available
summary(unemployment)
# unemployment_model is available
summary(unemployment_model)
# Get the correlation between the prediction and true outcome: rho and print it
(rho <- ___)
# Square rho: rho2 and print it
(rho2 <- ___)
# Get R-squared from glance and print it
(rsq_glance <- ___(___)$___)