Похожие слова в словаре
Поиск семантически похожих терминов находит широкое применение в информационном поиске. В этом упражнении вы потренируетесь находить наиболее семантически близкий термин к слову computer из словаря модели en_core_web_md.
Вектор слова computer уже извлечён и сохранён в переменной word_vector. Модель en_core_web_md загружена как nlp, а пакет NumPy — как np.
Для поиска семантически похожих терминов используйте функцию .most_similar() объекта nlp.vocab.vectors. Индексирование результата этой функции с помощью [0][0] возвращает идентификаторы слов похожих терминов. Функция nlp.vocab.strings[<слово>] позволяет найти идентификатор заданного слова и, наоборот, вернуть слово по его идентификатору.
Это упражнение является частью курса
Обработка естественного языка с помощью spaCy
Инструкции к упражнению
- Найдите наиболее семантически похожий термин в словаре
en_core_web_md. - Составьте список похожих слов по их идентификаторам.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Find the most similar word to the word computer
most_similar_words = nlp.vocab.vectors.____(np.asarray([____]), n = 1)
# Find the list of similar words given the word IDs
words = [nlp.____.____[____] for w in most_similar_words[0][0]]
print(words)