Rozpoznávání pojmenovaných entit v novinových titulcích
Zpravodajské organizace často označují pojmenované entity – jako jsou osoby, místa nebo organizace – v titulcích článků, aby zlepšily vyhledávání, indexování a doporučování obsahu. Tvým úkolem je použít Hugging Face pipeline k automatickému rozpoznání a seskupení těchto entit v novinovém titulku.
Toto cvičení je součástí kurzu
Zpracování přirozeného jazyka (NLP) v Pythonu
Pokyny k cvičení
- Vytvoř
ner_pipelines využitím modelu"dslim/bert-base-NER". - Extrahuj pojmenované entity z proměnné
headline.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
from transformers import pipeline
# Create the NER pipeline
ner_pipeline = pipeline(
task="____",
model="____",
grouped_entities=True
)
headline = "Apple is planning to open a new office in San Francisco next year."
# Get named entities
entities = ____
for entity in entities:
print(f"{entity['entity_group']}: {entity['word']}")