शुरू करेंमुफ़्त में शुरू करें

स्पैनिश रिव्यूज़ को स्टेम करें

आपको याद होगा कि पिछले चैप्टर में हमने अलग-अलग Amazon प्रोडक्ट रिव्यूज़ की भाषा पहचानने के लिए एक लैंग्वेज डिटेक्शन पैकेज का इस्तेमाल किया था। इस अभ्यास में, आप पहले non_english_reviews में मौजूद भाषाओं का पता लगाएँगे। रिव्यूज़ कई भाषाओं में हैं, लेकिन आपको केवल स्पैनिश वाले चुनने हैं। अगर कुछ कॉन्सेप्ट भूल गए हैं, तो विदेशी भाषा पहचान पर वीडियो को फिर से देख सकते हैं।

दूसरे चरण में, आप स्पैनिश रिव्यूज़ से वर्ड टोकन बनाएँगे और उन्हें स्पैनिश भाषा के लिए SnowBall स्टेमर से स्टेम करेंगे। दुर्भाग्य से, लैंग्वेज डिटेक्शन पैकेज परफेक्ट नहीं है। इसलिए कभी-कभी डिटेक्ट की गई भाषा गलत भी हो सकती है।

यह अभ्यास पाठ्यक्रम का हिस्सा है

Python में Sentiment Analysis

पाठ्यक्रम देखें

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# Import the language detection package
import ____

# Loop over the rows of the dataset and append  
languages = [] 
for i in ____(____(non_english_reviews)):
    languages.append(____.____(non_english_reviews.iloc[i, 1]))

# Clean the list by splitting     
languages = [str(lang).split(':')[0][1:] for lang in languages]
# Assign the list to a new feature 
non_english_reviews['language'] = languages

# Select the Spanish ones
filtered_reviews = non_english_reviews[non_english_reviews.language == 'es']
कोड संपादित करें और चलाएँ