Понимание метрик генерации текста
Команда PyBooks только что оценила качество работы предобученной модели с помощью показателя BLEU и получила результат около 0,082, а значение rouge1_fmeasure составило примерно 0,2692. Эти метрики отражают точность (какая доля выбранных элементов является релевантной) и полноту (какая доля релевантных элементов была выбрана). Как бы вы интерпретировали эти результаты с точки зрения качества модели?
Это упражнение является частью курса
Глубокое обучение для работы с текстом на PyTorch
Практическое интерактивное упражнение
Превратите теорию в практику с помощью одного из наших интерактивных упражнений
Начать упражнение