Загрузка метрик с помощью evaluate
Для оценки качества работы больших языковых моделей (БЯМ) необходимы метрики — так же, как и в классическом машинном обучении. Библиотека evaluate упрощает работу с этими моделями. Начнём с загрузки метрик для оценки классификационных моделей.
Библиотека evaluate уже загружена для вас.
Это упражнение является частью курса
Введение в LLM на Python
Инструкции к упражнению
- Загрузите метрики accuracy, precision, recall и F1.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Load the metrics
accuracy = ____
precision = ____
recall = ___
f1 = ____