ÎncepețiÎncepe gratuit

Vectori de cuvinte în vocabularul spaCy

Scopul vectorilor de cuvinte este acela de a permite unui calculator să înțeleagă cuvintele. În acest exercițiu, vei exersa extragerea vectorilor de cuvinte pentru o listă dată de cuvinte.

Lista de cuvinte este disponibilă ca words. Modelul en_core_web_md este deja importat și disponibil ca nlp.

Vocabularul modelului en_core_web_md conține 20.000 de cuvinte. Dacă un cuvânt nu există în vocabular, nu vei putea extrage vectorul de cuvânt corespunzător. În acest exercițiu, pentru simplitate, se garantează că toate cuvintele date există în vocabularul acestui model.

Acest exercițiu face parte din cursul

Procesarea limbajului natural cu spaCy

Vezi cursul

Instrucțiuni pentru exercițiu

  • Extrage ID-urile tuturor cuvintelor din words și stochează-le într-o listă ids.
  • Pentru fiecare ID din ids, stochează primele zece elemente ale vectorului de cuvânt în lista word_vectors.
  • Afișează primele zece elemente ale primului vector de cuvânt din word_vectors.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

words = ["like", "love"]

# IDs of all the given words
ids = [nlp.____.____[w] for w in words]

# Store the first ten elements of the word vectors for each word
word_vectors = [nlp.____.____[i][:10] for i in ids]

# Print the first ten elements of the first word vector
print(____[0])
Editează și rulează codul