or
이 연습은 강의의 일부입니다
이 장에서는 NLP와 그 활용 사례(개체명 인식, AI 기반 챗봇 등)를 소개합니다. 강력한 spaCy 라이브러리를 사용해 토큰화, 문장 구분, 품사 태깅, 개체명 인식 등 다양한 자연어 처리 작업을 수행하는 방법을 배웁니다.
현재 연습
언어적 특성, 단어 벡터, 의미 유사도, 유추, 단어 벡터 연산을 학습합니다. 이 장에서는 spaCy를 사용해 단어 벡터를 추출하고, 특정 주제와 관련된 텍스트를 분류하며, 코퍼스나 spaCy 모델의 어휘에서 주어진 단어와 의미적으로 유사한 용어를 찾는 방법을 알아봅니다.
spaCy 파이프라인 구성 요소를 익히고, 구성 요소를 추가하는 방법과 NLP 파이프라인을 분석하는 방법을 배웁니다. 또한 spaCy의 EntityRuler, Matcher, PhraseMatcher 클래스와 Python의 RegEx 패키지를 활용한 규칙 기반 정보 추출의 다양한 접근법도 살펴봅니다.
실제 환경에서 spaCy 모델이 실패할 수 있는 다양한 사례를 살펴보고, 모델 성능을 개선하기 위한 추가 학습 방법을 배웁니다. spaCy 학습 절차를 소개하고, 기존 spaCy 모델을 추가 학습하거나 처음부터 학습하는 방법, 그리고 추론 시점에서 모델을 평가하는 방법을 이해합니다.