Slovní vektory ve slovníku spaCy
Slovní vektory umožňují počítači porozumět slovům. V tomto cvičení si procvičíš extrakci slovních vektorů pro zadaný seznam slov.
Seznam slov je uložen jako words. Model en_core_web_md je již naimportován a dostupný jako nlp.
Slovník modelu en_core_web_md obsahuje 20 000 slov. Pokud slovo ve slovníku neexistuje, jeho slovní vektor nelze extrahovat. V tomto cvičení je pro jednoduchost zaručeno, že všechna zadaná slova jsou ve slovníku tohoto modelu obsažena.
Toto cvičení je součástí kurzu
Zpracování přirozeného jazyka s knihovnou spaCy
Pokyny k cvičení
- Extrahuj ID všech zadaných slov z
wordsa ulož je do seznamuids. - Pro každé ID ze seznamu
idsulož prvních deset prvků slovního vektoru do seznamuword_vectors. - Vypiš prvních deset prvků prvního slovního vektoru ze seznamu
word_vectors.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
words = ["like", "love"]
# IDs of all the given words
ids = [nlp.____.____[w] for w in words]
# Store the first ten elements of the word vectors for each word
word_vectors = [nlp.____.____[i][:10] for i in ids]
# Print the first ten elements of the first word vector
print(____[0])