Vectori de cuvinte în vocabularul spaCy
Scopul vectorilor de cuvinte este acela de a permite unui calculator să înțeleagă cuvintele. În acest exercițiu, vei exersa extragerea vectorilor de cuvinte pentru o listă dată de cuvinte.
Lista de cuvinte este disponibilă ca words. Modelul en_core_web_md este deja importat și disponibil ca nlp.
Vocabularul modelului en_core_web_md conține 20.000 de cuvinte. Dacă un cuvânt nu există în vocabular, nu vei putea extrage vectorul de cuvânt corespunzător. În acest exercițiu, pentru simplitate, se garantează că toate cuvintele date există în vocabularul acestui model.
Acest exercițiu face parte din cursul
Procesarea limbajului natural cu spaCy
Instrucțiuni pentru exercițiu
- Extrage ID-urile tuturor cuvintelor din
wordsși stochează-le într-o listăids. - Pentru fiecare ID din
ids, stochează primele zece elemente ale vectorului de cuvânt în listaword_vectors. - Afișează primele zece elemente ale primului vector de cuvânt din
word_vectors.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
words = ["like", "love"]
# IDs of all the given words
ids = [nlp.____.____[w] for w in words]
# Store the first ten elements of the word vectors for each word
word_vectors = [nlp.____.____[i][:10] for i in ids]
# Print the first ten elements of the first word vector
print(____[0])