Identificarea entităților denumite în titlurile știrilor
Organizațiile de știri etichetează adesea entități denumite – precum persoane, locații și organizații – în titluri, pentru a îmbunătăți căutarea, indexarea și recomandările. Sarcina ta este să folosești un pipeline Hugging Face pentru a detecta și grupa automat aceste entități într-un titlu de știre.
Acest exercițiu face parte din cursul
Procesarea Limbajului Natural (NLP) în Python
Instrucțiuni pentru exercițiu
- Creează un
ner_pipelinefolosind modelul"dslim/bert-base-NER". - Extrage entitățile denumite din
headline-ul dat.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
from transformers import pipeline
# Create the NER pipeline
ner_pipeline = pipeline(
task="____",
model="____",
grouped_entities=True
)
headline = "Apple is planning to open a new office in San Francisco next year."
# Get named entities
entities = ____
for entity in entities:
print(f"{entity['entity_group']}: {entity['word']}")