शब्दों की गिनती (II)
एक बार जब vectorizer को डेटा पर fit कर दिया जाता है, तो इसका उपयोग टेक्स्ट को ऐसे array में बदलने के लिए किया जा सकता है जो word counts को दर्शाता है. इस array में हर टेक्स्ट ब्लॉक के लिए एक row होगी और vectorizer द्वारा जनरेट किए गए प्रत्येक फीचर के लिए एक column होगा, जिन्हें आपने पिछले अभ्यास में देखा था.
पिछले अभ्यास में आपने जिस vectorizer को fit किया था (cv), वह आपके workspace में उपलब्ध है.
यह अभ्यास पाठ्यक्रम का हिस्सा है
Python में मशीन लर्निंग के लिए फीचर इंजीनियरिंग
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Apply the vectorizer
cv_transformed = ____(speech_df['text_clean'])
# Print the full array
cv_array = ____
print(cv_array)