Các bước chuẩn bị huấn luyện
Trước và trong khi huấn luyện một mô hình spaCy, bạn sẽ cần (1) vô hiệu hóa các thành phần pipeline khác để chỉ huấn luyện đúng thành phần mong muốn và (2) chuyển một Doc container của một điểm dữ liệu huấn luyện và annotations tương ứng thành lớp Example.
Trong bài tập này, bạn sẽ luyện tập hai bước trên bằng cách dùng mô hình en_core_web_sm đã được nạp sẵn, truy cập qua nlp. Lớp Example đã được import và một chuỗi text cùng các annotations liên quan cũng đã sẵn sàng để bạn sử dụng.
Bài tập này là một phần của khóa học
Xử lý ngôn ngữ tự nhiên với spaCy
Hướng dẫn bài tập
- Vô hiệu hóa tất cả các thành phần pipeline của mô hình
nlpngoại trừner. - Chuyển một chuỗi
textvà cácannotationscủa nó sang đúng định dạng có thể dùng cho huấn luyện.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
nlp = spacy.load("en_core_web_sm")
# Disable all pipeline components of except `ner`
other_pipes = [____ for ____ in nlp.____ if ____ != 'ner']
nlp.____(*other_pipes)
# Convert a text and its annotations to the correct format usable for training
doc = nlp.____(text)
example = Example.____(____, ____)
print("Example object for training: \n", example.to_dict())