spaCy 模型在一般 NLP 情境相當實用,例如把文件切分成句子、解析句子語法,以及抽取具名實體。不過,有時你會需要自行訓練一個 spaCy 模型。
什麼時候需要訓練 spaCy 模型?請選出所有適用的選項。
本練習屬於課程
將理論付諸實踐,立即體驗我們的互動練習
本章將帶你認識 NLP,以及其應用情境,如命名實體辨識與以 AI 驅動的聊天機器人。你將學會使用功能強大的 spaCy 函式庫,執行各種自然語言處理任務,例如斷詞、句子切分、詞性標註與命名實體辨識。
認識語言學特徵、詞向量、語意相似度、類比,以及詞向量運算。本章將示範如何使用 spaCy 擷取詞向量、將文件歸類到特定主題,並從語料庫或 spaCy 模型的詞彙中,找出與指定單字在語意上相近的詞。
熟悉 spaCy 的 pipeline 元件、如何新增元件,以及分析 NLP pipeline。你也會學到多種以規則為基礎的資訊擷取方法,例如使用 spaCy 的 EntityRuler、Matcher 與 PhraseMatcher 類別,以及 Python 的 RegEx 套件。
探索多種真實情境中 spaCy 模型可能失效的案例,並學習如何進一步訓練以提升模型效能。你將認識 spaCy 的訓練流程,了解如何在現有 spaCy 模型上持續訓練或從零開始訓練,並在推論階段評估模型。
當前練習