텍스트 생성 평가 지표 이해하기
PyBooks 팀이 사전 학습된 모델의 성능을 BLEU 점수로 평가했더니 약 0.082, rouge1_fmeasure는 약 0.2692로 나왔습니다. 이 지표는 정밀도(선택된 항목 중 관련 있는 비율)와 재현율(관련 있는 항목 중 선택된 비율)을 나타냅니다. 이 점수를 모델 성능 관점에서 어떻게 해석하시겠어요?
이 연습은 강의의 일부입니다
PyBooks 팀이 사전 학습된 모델의 성능을 BLEU 점수로 평가했더니 약 0.082, rouge1_fmeasure는 약 0.2692로 나왔습니다. 이 지표는 정밀도(선택된 항목 중 관련 있는 비율)와 재현율(관련 있는 항목 중 선택된 비율)을 나타냅니다. 이 점수를 모델 성능 관점에서 어떻게 해석하시겠어요?
이 연습은 강의의 일부입니다