Beroendeparsning med spaCy
Beroendeparsning analyserar den grammatiska strukturen i en mening och identifierar relaterade ord samt typen av relation mellan dem. En vanlig tillämpning är att hitta subjekt och objekt i en mening. I den här övningen tränar du på att extrahera beroendeetiketter för givna texter.
Tre kommentarer från datamängden Airline Travel Information System (ATIS) finns tillgängliga i en lista som heter texts. Modellen en_core_web_sm är redan inläst och tillgänglig som nlp.
Den här övningen är en del av kursen
Naturlig språkbehandling med spaCy
Övningsinstruktioner
- Skapa en lista
documentssom innehållerdoc-behållarna för varje element i listantexts. - Skriv ut en tupel med (tokens text, beroendeetikett och etikettens förklaring) för varje
doc-behållare.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Create a list of Doc containts of texts list
documents = [____ for t in ____]
# Print each token's text, dependency label and its explanation
for doc in documents:
print([(token.____, token.____, spacy.____(token.____)) for token in doc], "\n")