Dependency parsing se spaCy
Dependency parsing analyzuje gramatickou strukturu věty a odhaluje vzájemně související slova i typ vztahu mezi nimi. Jedním z praktických využití dependency parsingu je identifikace podmětu a předmětu ve větě. V tomto cvičení si procvičíš extrakci dependency labelů pro zadané texty.
V listu texts máš k dispozici tři komentáře z datasetu ATIS (Airline Travel Information System). Model en_core_web_sm je již načtený a dostupný jako nlp.
Toto cvičení je součástí kurzu
Zpracování přirozeného jazyka s knihovnou spaCy
Pokyny k cvičení
- Vytvoř list
documentsobsahující kontejnerydocpro každý prvek listutexts. - Pro každý kontejner
docvypiš tuple obsahující (text tokenu, dependency label a jeho vysvětlení).
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Create a list of Doc containts of texts list
documents = [____ for t in ____]
# Print each token's text, dependency label and its explanation
for doc in documents:
print([(token.____, token.____, spacy.____(token.____)) for token in doc], "\n")