Začněte nyníZačněte zdarma

Rozpoznávání pojmenovaných entit v novinových titulcích

Zpravodajské organizace často označují pojmenované entity – jako jsou osoby, místa nebo organizace – v titulcích článků, aby zlepšily vyhledávání, indexování a doporučování obsahu. Tvým úkolem je použít Hugging Face pipeline k automatickému rozpoznání a seskupení těchto entit v novinovém titulku.

Toto cvičení je součástí kurzu

Zpracování přirozeného jazyka (NLP) v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Vytvoř ner_pipeline s využitím modelu "dslim/bert-base-NER".
  • Extrahuj pojmenované entity z proměnné headline.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

from transformers import pipeline
# Create the NER pipeline
ner_pipeline = pipeline(
    task="____",
    model="____",
    grouped_entities=True
)
headline = "Apple is planning to open a new office in San Francisco next year."

# Get named entities
entities = ____

for entity in entities:
    print(f"{entity['entity_group']}: {entity['word']}")
Upravit a spustit kód