Ordvektorer i spaCy:s vokabulär
Ordvektorer används för att ge datorn en förståelse för ords betydelse. I den här övningen får du träna på att extrahera ordvektorer för en given lista med ord.
En lista med ord är definierad som words. Modellen en_core_web_md är redan importerad och tillgänglig som nlp.
Vokabulären i en_core_web_md innehåller 20 000 ord. Om ett ord inte finns i vokabulären går det inte att extrahera dess ordvektor. I den här övningen är det säkerställt att alla angivna ord finns i modellens vokabulär.
Den här övningen är en del av kursen
Naturlig språkbehandling med spaCy
Övningsinstruktioner
- Extrahera ID:n för alla ord i
wordsoch lagra dem i en lista kalladids. - För varje ID i
ids, lagra de första tio elementen av ordvektorn i listanword_vectors. - Skriv ut de första tio elementen av den första ordvektorn i
word_vectors.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
words = ["like", "love"]
# IDs of all the given words
ids = [nlp.____.____[w] for w in words]
# Store the first ten elements of the word vectors for each word
word_vectors = [nlp.____.____[i][:10] for i in ids]
# Print the first ten elements of the first word vector
print(____[0])