Kom igångKom igång gratis

Ordvektorer i spaCy:s vokabulär

Ordvektorer används för att ge datorn en förståelse för ords betydelse. I den här övningen får du träna på att extrahera ordvektorer för en given lista med ord.

En lista med ord är definierad som words. Modellen en_core_web_md är redan importerad och tillgänglig som nlp.

Vokabulären i en_core_web_md innehåller 20 000 ord. Om ett ord inte finns i vokabulären går det inte att extrahera dess ordvektor. I den här övningen är det säkerställt att alla angivna ord finns i modellens vokabulär.

Den här övningen är en del av kursen

Naturlig språkbehandling med spaCy

Visa kurs

Övningsinstruktioner

  • Extrahera ID:n för alla ord i words och lagra dem i en lista kallad ids.
  • För varje ID i ids, lagra de första tio elementen av ordvektorn i listan word_vectors.
  • Skriv ut de första tio elementen av den första ordvektorn i word_vectors.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

words = ["like", "love"]

# IDs of all the given words
ids = [nlp.____.____[w] for w in words]

# Store the first ten elements of the word vectors for each word
word_vectors = [nlp.____.____[i][:10] for i in ids]

# Print the first ten elements of the first word vector
print(____[0])
Redigera och kör kod