Настройка параметров разбора CSV
Файл с данными о производительности сотрудников содержит значения "N/A", появившиеся из-за ошибок при ручном вводе данных. Если не обработать их при импорте, они будут восприняты как текстовые строки, а не как пропущенные значения — это приведёт к неверным типам столбцов и ошибкам в вычислениях. Правильная настройка индикаторов пропущенных значений заранее позволяет сэкономить часы отладки.
Классы Table и CsvReadOptions уже импортированы.
Это упражнение является частью курса
Импорт данных в Java
Инструкции к упражнению
- Выведите структуру таблицы
defaultParsing. - Загрузите файл в переменную
customParsing, настроив обработку"N/A"как пропущенного значения. - Выведите структуру таблицы
customParsing.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
public class ParseCSVFiles {
public static void main(String[] args) {
try {
Table defaultParsing = Table.read().csv("employee_performance.csv");
System.out.println("Default parsing structure:");
// Print the structure of defaultParsing
System.out.println(defaultParsing.____);
System.out.println(defaultParsing.first(3).print());
// Load the file as customParsing with "N/A" handled as missing
Table customParsing = Table.read().csv(
____.builder("employee_performance.csv")
.____(____)
.build()
);
System.out.println("\nCustom missing value parsing structure:");
// Print the structure of customParsing
System.out.println(customParsing.____);
System.out.println(customParsing.first(3).print());
} catch (Exception e) {
System.err.println("Error reading CSV files: " + e.getMessage());
}
}
}