Для этого урока мы заранее разделили датасет на четыре CSV-файла: с обучающими входными признаками, обучающими целевыми, тестовыми входными и тестовыми целевыми. Вам нужно сохранить всю информацию в переменные.
После чтения файлов выведите по пять первых наблюдений каждой из четырёх частей датасета и проверьте данные на глаз.
# необходимые импорты
import numpy as np
import pandas as pd
# считывание CSV-файлов
X_train = pd.read_csv('real_estate_x_train.csv')
y_train = pd.read_csv('real_estate_y_train.csv')
X_test = pd.read_csv('real_estate_x_test.csv')
y_test = pd.read_csv('real_estate_y_test.csv')
# вывод первых 5 наблюдений обучающих признаков тренировочной выборки
print(X_train.head())
# вывод первых 5 наблюдений целевого признака тренировочной выборки
print(y_train.head())
# вывод первых 5 наблюдений обучающих признаков тестовой выборки
print(X_test.head())
# вывод первых 5 наблюдений целевого признака тестовой выборки
print(y_test.head())