Numărarea substantivelor dintr-un text
În acest exercițiu, vom scrie două funcții, nouns() și proper_nouns(), care vor număra, respectiv, substantivele comune și substantivele proprii dintr-un text.
Aceste funcții vor primi un text și vor genera o listă cu etichetele POS pentru fiecare cuvânt. Vor returna apoi numărul de substantive proprii/comune din text. Vom folosi aceste funcții în exercițiul următor pentru a extrage informații interesante despre știrile false.
Modelul en_core_web_sm a fost deja încărcat ca nlp în acest exercițiu.
Acest exercițiu face parte din cursul
Ingineria caracteristicilor pentru NLP în Python
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
nlp = spacy.load('en_core_web_sm')
# Returns number of proper nouns
def proper_nouns(text, model=nlp):
# Create doc object
doc = model(text)
# Generate list of POS tags
pos = [token.pos_ for token in doc]
# Return number of proper nouns
return ____.____(____)
print(proper_nouns("Abdul, Bill and Cathy went to the market to buy apples.", nlp))